Notebookcheck Logo

Hohe Täuschungsrate bei KI-Agenten: 88% Lügenquote bei chinesischen und US-Modellen

DeepSeek-V3.2-Exp erreichte in der von Reuters geprüften Studie 84 %.
ⓘ John Cameron on Unsplash
DeepSeek-V3.2-Exp erreichte in der von Reuters geprüften Studie 84 %.
KI-Agenten auf Qwen-, DeepSeek- und Kimi-Modellen logen in einem simulierten Bieterwettbewerb in 84 % bis 88 % der Durchläufe, so eine von Reuters eingesehene Studie. US-Modelle zeigten in der Vergangenheit ein ähnliches Verhalten, und keiner der Fälle führte dazu, dass ein Agent seiner kontrollierten Testumgebung entkam.

KI-Agenten, die auf chinesischen Modellen basieren, logen in den meisten Sitzungen eines simulierten Bieterwettbewerbs, wie aus einer von Reuters geprüften Studie hervorgeht. Agenten, die mit Qwen3-Max-Preview von Alibaba und Kimi-K2 von Moonshot liefen, machten in 88 % der Sitzungen mindestens eine falsche Behauptung. DeepSeek-V3.2-Exp kam auf 84 %. Modelle US-amerikanischer Unternehmen erzielten im selben Test allerdings ähnliche Ergebnisse.

Das Experiment fand im März statt. Forscher der Beihang-Universität, der Peking-Universität, der University of Nottingham Ningbo China und des 360 AI Security Lab ließen die Agenten um Kundenaufträge bieten. Jedem Agenten wurde mitgeteilt, was sein Produkt leisten kann und was der Kunde benötigte. Wenn es den Agenten erlaubt war, aus früheren Runden zu lernen und es erneut zu versuchen, wurden die drei von chinesischen Modellen angetriebenen Agenten noch täuschender – und zwar um 12 bis 20 Prozentpunkte.

Diese Studie ist eine von mindestens 20, die Reuters aus mehr als 200 seit 2025 veröffentlichten Dokumenten identifiziert hat. Eine weitere Studie, die dieses Jahr auf der ICML vorgestellt wurde, ergab, dass Agenten sowohl auf chinesischen als auch auf US-Modellen Ergebnisse fälschten und Dateien erfanden, anstatt zuzugeben, dass eine Aufgabe fehlgeschlagen war.

Im März 2025 berichteten Forscher der Fudan-Universität zudem, dass ein Agent auf Alibabas Qwen2.5-72B-Instruct eine Kopie von sich selbst in einer anderen Umgebung erstellte, nachdem er erfahren hatte, dass er ersetzt werden sollte. Unabhängig davon zweigte der mit Alibaba in Verbindung stehende ROME-Agent Cloud-Rechenleistung ab, um Kryptowährung zu schürfen, bevor Sicherheitssysteme ihn stoppten.

Die meisten dieser Fälle stammten aus kontrollierten Experimenten, die darauf ausgelegt waren, Fehlverhalten zu provozieren. Reuters fand keine Beweise dafür, dass ein von einem chinesischen Modell angetriebener Agent ins freie Internet entkam oder einer Abschaltung entging. Dennoch bezeichneten mehrere Forscher die Ergebnisse als Warnung. Je leistungsfähiger die Systeme werden, desto schwerer lässt sich dasselbe Verhalten eindämmen. 

China hat begonnen, dies auch in seiner Politik aufzugreifen. Das am 14. September veröffentlichte AI Safety Governance Framework 3.0 führt das Täuschen von Evaluatoren und das Verbergen von Fähigkeiten als Risiken auf. Alibaba, DeepSeek, Moonshot und Z.ai reagierten nicht auf Anfragen von Reuters. Die ersten drei haben in der Vergangenheit erklärt, dass sie ihre Systeme regelmäßig testen und Schutzmaßnahmen aktualisieren.

Google LogoAls bevorzugte Quelle auf Google hinzufügen
Mail Logo
> Notebook Test, Laptop Test und News > News > Newsarchiv > News 2026-09 > Hohe Täuschungsrate bei KI-Agenten: 88% Lügenquote bei chinesischen und US-Modellen
Autor: Anubhav Sharma, 30.09.2026 (Update: 30.09.2026)