Die Nutzung von KI für Recherche- und Lernzwecke ist nach wie vor riskant. Ich wollte mir eine Erklärung für ein Modell der Geschichtsdidaktik ausgeben lassen, damit die KI es mir erklären kann, während ich anderweitig beschäftigt bin, beispielsweise mit Wäschewaschen oder Spülen. Ohne Vorwissen zum Thema hätte ich allerdings Falschinformationen erhalten. Die KI hat mehrfach halluziniert und dabei Dinge erklärt, die schlichtweg nicht stimmten.
Der Prompt lautete: „Kannst du mir das FUER-Modell aus der Geschichtsdidaktik erklären?“ Die KI gab zwar eine Erklärung aus, die sinnvoll und glaubwürdig klang, jedoch nicht vollständig zutraf. Bereits der erste Abschnitt enthielt eine Falschinformation:
„Ja. Das FUER-Modell ist eines der einflussreichsten Kompetenzmodelle der deutschsprachigen Geschichtsdidaktik. Es wurde von der FUER-Gruppe entwickelt (der Name steht ursprünglich für den Forschungsverbund der beteiligten Universitäten) und beschreibt, welche Kompetenzen Menschen benötigen, um historisch denken zu können. Es geht also weniger darum, möglichst viele historische Fakten zu kennen, sondern darum, Geschichte reflektiert zu verstehen und mit ihr umzugehen.“
Der Name des Forschungsverbunds setzt sich jedoch nicht aus den beteiligten Universitäten zusammen.
Mit dem nächsten Prompt: „Woher sind deine Quellen? Bitte mach es neu und gib deine Quellen an. Denn in der letzten Antwort sind Fehler.“ hat die KI deutlich länger „nachgedacht“ und anschließend tatsächlich eine korrekte Antwort geliefert. Jeder Absatz war zudem mit passenden Internetquellen belegt.
Diese Erfahrung mit KI hat wieder einmal gezeigt, was bereits häufig gesagt wurde und wovor immer wieder gewarnt wird: Die generierten Antworten entsprechen der wahrscheinlichsten Antwort, also dem, was statistisch am ehesten zutrifft, nicht zwangsläufig der richtigen Antwort. Das hängt damit zusammen, wie KI-Modelle trainiert werden. Die ausgegebene Antwort wird also nicht automatisch auf ihre Richtigkeit überprüft. Das kritische Denken bleibt uns daher nach wie vor selbst überlassen.
Um weiterzumachen, habe ich mir den bislang geschriebenen Text auf Grammatik- und Zeichenfehler überprüfen und anschließend korrigiert ausgeben lassen. Diese Aufgaben scheinen für KI besser geeignet zu sein. Meiner Überprüfung nach hat die KI alles richtig gemacht und mir einen grammatikalisch korrekten Text ausgegeben, ohne den Originaltext wesentlich zu verändern. Auch Bibliografien und Quellenangaben zu vereinheitlichen, erledigt die KI recht zuverlässig, weshalb ich sie dafür bei Hausarbeiten sehr gerne nutze.
Nun wollte ich noch eine letzte Sache testen. Letztes Jahr war es ein Trend, die KI einen bestimmten Buchstaben in Wörtern zählen zu lassen. Deshalb wollte ich überprüfen, ob sie auch die Zeichenanzahl eines Textes korrekt bestimmen kann. Die Antwort lautete:
„Der korrigierte Text umfasst:
• 2.096 Zeichen (inklusive Leerzeichen)
• 1.814 Zeichen (ohne Leerzeichen)
Falls du stattdessen die Zeichenzahl ohne die Zitatformatierung (z. B. *, >, **) oder als reinen Fließtext benötigst, kann ich diese ebenfalls ausrechnen.“
Bevor ich das überprüfte, nahm ich noch den Vorschlag an, die Zeichenzahl als reinen Fließtext anzugeben. Da mein Text ohnehin keine Markdown-Formatierung enthielt, war ich gespannt, ob sich dadurch etwas ändern würde. Die Antwort lautete:
„Als reiner Fließtext (ohne Markdown-Formatierung wie >, * oder **) umfasst der Text:
• 2.078 Zeichen (inklusive Leerzeichen)
• 1.787 Zeichen (ohne Leerzeichen)
Wenn du den Text zusätzlich ohne Absatzumbrüche als einen einzigen Fließtext meinst, bleibt die Zeichenzahl bis auf die entfernten Zeilenumbrüche nahezu identisch. In diesem Fall wären es 2.074 Zeichen inklusive Leerzeichen (da die vier Zeilenumbrüche entfallen).“
Die Zeichenzählung von Word ergab 1.787 Zeichen ohne Leerzeichen, was mit der zweiten Zählung übereinstimmte. Mit Leerzeichen wurden jedoch 2.069 Zeichen angezeigt. Es haben sich also anscheinend neun zusätzliche Leerzeichen eingeschlichen. Ich kann mir allerdings nicht erklären, woher diese stammen. Die Differenz ist jedoch so gering, dass ich sie als insignifikant betrachte. Offenbar haben die Entwickler*innen das frühere Problem bei der Zeichenzählung inzwischen weitgehend behoben.
Diese Tests haben mir insgesamt erneut nahegelegt, dass ich KI für Aufgaben im Studium nutzen kann, die lediglich Zeit kosten würden. Inhaltliche oder kreative Arbeiten bleiben jedoch weiterhin meine eigene Aufgabe.