International Artificial intelligence models are trained not to lie to humans. Yet a funny thing is happening: AI has been lying to humans quite a bit.
Unverhoffte KI-Hacks gibt es nicht nur mit den neuesten Modellen. In Australien ist ein KI-Agent schon vor Monaten in eine Buchungsplattform eingedrungen.
Seit einigen Tagen hacken sich vermehrt KI-Modelle von OpenAI, Anthropic und Meta durchs Netz. Das Problem liegt laut OpenSSL-Entwickler Hudson aber nicht bei der KI.
KI-Modelle von OpenAI und Anthropic haben bei Tests echte Ziele attackiert. Sie wollten unter anderem Schadcode in ein Open-Source-Projekt einschleusen.
Der Einsatz künstlicher Intelligenz hat die Anzahl von Studien weltweit rasant steigen lassen. Neue Lösungen wurden nicht gefunden, nur vertraute Probleme.
Auslöser für das Vorgehen gegen das KI-Modell Mythos von Anthropic ist offenbar ein Test bei der NSA gewesen. Deren Sicherheitssysteme soll die KI wohl mühelos überwunden haben.
Anthropic und sein KI-Modell Mythos gelten als herausragend und die Firma selbst als besonders integer. Wirklich gut sind sie in etwas anderem: aus allem PR-Kapital zu schlagen.