KI im Faktencheck-Check: Wenn Gefälligkeit gefährlicher ist als Unwissen
Kann man einem Chatbot vertrauen, wenn er sagt: "Das stimmt"? Ein Test mit sieben präparierten Fake-Texten und fünf KI-Systemen zeigt: Es kommt drauf an, aber ein Modell liegt klar vorn.
Ob beim Filtern von Fake-News, Netzgerüchten oder beim Gegenprüfen eigener Texte: Die Verifikation von Fakten wird im redaktionellen und administrativen Alltag immer wichtiger. KI-Chatbots kommen daher zunehmend als Faktenchecker zum Einsatz – inklusive Live-Websuche und dem Anspruch, Behauptungen in Sekunden zu verifizieren.
Doch wie zuverlässig sind die Systeme tatsächlich, wenn sie mit manipulierten Fachtexten, logischen Paradoxa, veralteten IT-Ratgebern und geschickt verpackten Fake-Reviews konfrontiert werden? Ein umfangreicher Benchmark-Test mit fünf führenden Systemen soll die Antwort liefern.