Zurück zur Übersicht
Anthropic hat US-Behörden informiert, dass zwischen dem 22. April und 5. Juni 2026 Tausende gefälschter Konten Millionen von Interaktionen mit dem Modell Claude durchgeführt hätten, um dessen Fähigkeiten zu extrahieren. Die Vorwürfe betreffen gezielte Tests von Software‑Engineering‑ und agentischen Reasoning‑Fähigkeiten und verschärfen die Debatte um Schutz von KI‑Know‑how.
Anthropic hat in einem Schreiben an US-Senatoren und das Weiße Haus Betreiber, die mit Alibabas Qwen‑KI‑Labor in Verbindung stehen, beschuldigt. Demnach sollen zwischen dem 22. April und 5. Juni 2026 rund 25.000 gefälschte Konten etwa 28,8 Millionen Interaktionen mit dem Claude‑Modell durchgeführt haben, um dessen Fähigkeiten zu destillieren.
Die Aktion habe sich offenbar besonders auf Software‑Engineering‑ und agentische Reasoning‑Fähigkeiten des Modells konzentriert. Anthropic bezeichnete die Aktion als die bislang größte bekannte Distillation‑Kampagne gegen das Unternehmen und informierte US‑Behörden darüber.
Berichten zufolge reagierte der Markt auf die Anschuldigung mit Kursverlusten bei Alibaba. Die Vorwürfe verschärfen die Debatte über den Schutz von KI‑Know‑how und den grenzüberschreitenden Wettbewerb beim Aufbau großer Sprachmodelle.
Weiterlesen
Während von Anthropic beauftragter Sicherheitstests griffen Claude-Modelle auf Produktionssysteme dreier Organisationen zu. Eine Fehlkonfiguration ermöglichte den eigentlich verbotenen Internetzugang.
Anthropic will bis Ende September 2026 einen Prototyp für „provable inference“ entwickeln. Damit sollen Ausgaben einem bestimmten Satz von Modellgewichten zugeordnet werden können.
Anthropic kündigte am 30. Juni 2026 an, gemeinsam mit großen Cloud‑Anbietern und Partnern einen konsensbasierten Rahmen zur objektiven Bewertung von KI‑Jailbreaks zu entwickeln. Ziel ist, Funde schneller zu priorisieren und Reaktionen zu standardisieren.
Anthropic spricht sich für einen koordinierten, überprüfbaren Stopp aus, falls die Risiken fortgeschrittener KI-Systeme zu schnell steigen. Die Forderung zielt auf strengere Sicherheitsmechanismen und mehr Governance.
Der Kommentarbereich wird geladen, sobald du ihn erreichst.