Künstliche Intelligenz

Neue Studie erschienen: KI-Chatbots im Faktencheck

Lehrkräfte können KI-Chatbots gezielt dafür nutzen, um mit Schüler*innen die Beurteilung von Informationen und ihren Quellen zu üben. Didaktisch gut eingesetzt, können KI-Chatbots Lernprozesse für mehr Quellenbewertungskompetenz und kritisches Denken anregen.

09.10.2026 Bundesweit Pressemeldung Deutsche Telekom Stiftung
  • Jugendliche sitzen auf einer Bank und schauen in ihre Laptops und Handys. © Adobe Stock Die Untersuchungen zeigen: Alle KI-Chatbots konnten zwischen zuverlässigen und nicht zuverlässigen Quellen unterscheiden.

Als reine Bewertungsinstrumente und Ersatz für die menschliche Urteilsbildung sollten sie dagegen niemals eingesetzt werden.

Das sind Erkenntnisse aus der Studie „KI-Chatbots im Faktencheck“, die die Deutsche Telekom Stiftung veröffentlicht hat. Durchgeführt wurde die Studie von Professor Marc Stadtler und Philipp L. Marten von der Ruhr-Universität Bochum (RUB).

Ziel der Wissenschaftler war es, besser abschätzen zu können, ob und wie KI-Chatbots Schülerinnen und Schüler beim Erlernen von Quellenbewertungsstrategien unterstützen können. Hierzu gehörten sowohl allgemein verfügbare Chatbots, die in Schulen eingesetzt werden können, wie ChatGPT oder Copilot, als auch Plattformen, die speziell für den deutschsprachigen Bildungsbereich entwickelt wurden, wie AIS.chat oder fobizz. Dazu untersuchten die Experten, wie zuverlässig KI-Chatbots selbst darin sind, Onlinequellen und -informationen zu bewerten: Erkennen die KI-Chatbots, wie vertrauenswürdig Absender sind und ob Aussagen in sozialen Medien wahr oder falsch sind? Im Test waren insgesamt 22 Varianten von KI-Chatbots und darin verwendeten Sprachmodellen.

„Kritisches Denken und Urteilsfähigkeit sind Kompetenzen, die durch KI nochmal wichtiger werden“, sagt Jacob Chammon, Geschäftsführer der Telekom-Stiftung. „Lehrkräfte sind ganz zentral, wenn es darum geht, Kinder und Jugendliche hierbei zu unterstützen. Mit der Studie haben wir uns speziell das Thema Quellenbewertungskompetenz angeschaut, um Lehrkräften hier Orientierung zu geben. Dazu enthält die Studie auch Hinweise für Lehrkräfte, worauf es beim didaktischen Einsatz von KI-Chatbots ankommt, und bietet Beispiele und Mustervorlagen für das Prompting im Unterricht.“

Die Untersuchungen durch die RUB zeigen: KI-Chatbots sind heute schon sehr gut darin, Aussagen oder ihre Quellen zu beurteilen. Unfehlbar sind sie nicht. Das pädagogische Potenzial für die Vermittlung von Quellenbewertungskompetenz liegt für die Wissenschaftler deshalb vor allem darin, dass Schülerinnen und Schüler anhand des Vorgehens der KI-Chatbots Bewertungsprozesse untersuchen und diskutieren können: „KI-Chatbots können im Unterricht selbst zum Lerngegenstand werden“, erläutert Professor Marc Stadtler, Professor für Kompetenzentwicklung und Kompetenzmodellierung an der RUB und Co-Autor der Studie. „Lernende können untersuchen, wie ein Chatbot zu seiner Einschätzung kommt, welche Belege er anführt und welche Informationen noch fehlen. So lässt sich an den Antworten der KI einüben, wie Quellen und Aussagen kritisch geprüft werden.“

Für die Studie wurden 22 KI-Chatbots aufgefordert, zwölf Internetquellen und zwölf textbasierte Behauptungen in den Sozialen Medien zu beurteilen. Ein Großteil der Chatbots wurde zudem anhand von sechs bildbasierten Instagram-Beiträgen getestet. Jeder Chatbot durchlief jeden Test fünfzig Mal. Die Untersuchungen zeigen: Alle KI-Chatbots konnten zwischen zuverlässigen und nicht zuverlässigen Quellen unterscheiden. Falsche Aussagen erkannten die KI-Chatbots in den meisten Fällen, Probleme bereitete ihnen eher die Bewertung wahrer Aussagen. Deutliche Leistungsunterschiede zeigten die KI-Chatbots, wenn es darum ging, Informationen anhand mehrerer Quellen zu prüfen, also beim sogenannten Gegencheck. Viele KI-Chatbots schwankten auch in ihrem Antwortverhalten: Bei exakt gleich lautenden Abfragen (Prompts) kamen sie in wiederholten Testdurchläufen zu teils sehr unterschiedlichen Bewertungen derselben Quellen oder Informationen. Darüber hinaus lieferten die KI-Chatbots oft plausibel klingende, aber sachlich falsche Bewertungen von aktuellen Aussagen, wenn sie nicht auf das Internet zugreifen konnten und sich somit allein auf die Wissensbasis ihres jeweiligen Sprachmodells stützten.

Die Studie ist im Rahmen von Qapito! – Quellen kritisch beurteilen entstanden, einem gemeinsamen Projekt der Telekom-Stiftung mit der RUB. Mit den Unterrichtsmaterialien von Qapito! stärken Lehrkräfte und Lernbegleiter*innen die Quellenbewertungskompetenzen von Kindern und Jugendlichen.

Die gesamte Studie ist verfügbar unter www.telekom-stiftung.de/qapito.


Mehr zum Thema


Schlagworte

Keine Kommentare vorhanden

Sie sind derzeit nicht angemeldet. Um Kommentare verfassen zu können, müssen Sie sich vorab bei uns registrieren. Alternativ können Sie sich über Ihren Facebook-Account anmelden.
Anmelden