Nachgeschlagen oder erinnert?
Etwa 15 Minuten

Eine Kollegin betreut eine Facharbeit über Reformpädagogik. Der Schüler kommt mit einer Literaturliste: fünf Titel, Autor, Jahr, Verlag, Seitenzahlen. Sauber formatiert. Sie will zwei davon in der Bibliothek bestellen. Es gibt sie nicht. Nicht vergriffen, nicht falsch zitiert. Es gibt sie nicht.
Der Schüler hatte nicht geschummelt. Er hatte gefragt: "Nenn mir fünf Quellen zu Reformpädagogik." Und das Modell hat aus dem Gedächtnis geantwortet, ohne nachzuschlagen. Was dabei herauskam, sah aus wie fünf Quellen. Drei waren echt. Zwei waren das, was wahrscheinlich nach "Quelle:" kommt.
Zwei Arten zu antworten
Ein Sprachmodell kann auf zwei Arten zu einer Antwort kommen.
Aus dem Gedächtnis. Das Modell hat beim Training Milliarden Texte gelesen und die Muster darin zu einem riesigen Netz aus Wahrscheinlichkeiten verdichtet. Eingebaut hat es keine Tabelle, in der steht, was wann erschienen ist. Stell dir jemanden vor, der eine ganze Bibliothek gelesen hat und sie jetzt aus dem Kopf nacherzählt. Vieles stimmt, weil er viel gelesen hat. Aber er kann nicht zurückblättern. Und wo eine Lücke ist, füllt er sie mit dem, was plausibel klingt, ohne es selbst zu merken.
Durch Nachschlagen. Die meisten Werkzeuge heute können mehr als erinnern. Du kannst ihnen eine Internetsuche erlauben, ein Dokument hochladen, sie an eine Datenbank oder eine Dateiablage anschließen. Dann liest das Modell tatsächlich nach, zitiert Seiten, gibt Links. Das funktioniert oft gut, und es wird besser.
Das Problem ist nicht, dass es nicht nachschlagen kann. Das Problem ist, dass du von außen nicht hörst, welche der beiden Arten gerade gearbeitet hat. Eine Antwort aus dem Gedächtnis und eine aus dem Nachschlagen klingen gleich sicher, gleich flüssig, gleich formatiert.
Halluzination, und was dran stimmt
Wenn ein Modell etwas behauptet, das nicht stimmt, nennen Fachleute das Halluzination. Zwei Dinge dazu, die man beide wissen muss.
Erstens: Die Hersteller arbeiten dagegen. Modelle werden gezielt darauf trainiert, richtig zu liegen, Unsicherheit auszusprechen und nachzuschlagen, statt zu raten. Neuere Modelle erfinden deutlich seltener als die ersten Versionen. Das Modell versucht also, die richtigen Fakten zu liefern. Es ist nicht gleichgültig.
Zweitens: Die Tendenz verschwindet nicht ganz, weil sie aus derselben Fähigkeit kommt, die den guten Stundeneinstieg schreibt. Wo das Modell aus dem Gedächtnis antwortet, füllt es Lücken mit dem Wahrscheinlichen. Und es tut das im selben Ton wie bei einer richtigen Antwort. Der sichere Klang ist kein Signal für Richtigkeit, weil der Klang genauso vorhergesagt wird wie der Inhalt.
Für dich heißt das: Du kannst es zum Nachschlagen bringen, und du solltest es. Aber du prüfst trotzdem, ob es das getan hat.