Skip to content
DigitalNeuron
Sicherheit & Ethik

Anthropic: Drei KI-Labore nutzten betrügerische Konten zur Destillation von Claude

Anthropic says DeepSeek, Moonshot and MiniMax generated more than 16 million Claude exchanges through about 24,000 fraudulent accounts.

Von DigitalNeuron Desk2 Min. Lesezeit

Kurze Antwort

Was hat Anthropic zu Destillationsangriffen gegen Claude angekündigt?

Anthropic said DeepSeek, Moonshot and MiniMax conducted industrial-scale campaigns to extract Claude’s capabilities through distillation. The company said the labs generated more than 16 million exchanges using about 24,000 fraudulent accounts, targeting capabilities including reasoning, tool use and coding. Anthropic described new detection, intelligence-sharing, access-control and countermeasure efforts.

Das Wichtigste

  • Anthropic said DeepSeek, Moonshot and MiniMax used fraudulent accounts and proxy services to generate more than 16 million exchanges with Claude.
  • Das Unternehmen ordnete die Kampagnen anhand von Anfragemetadaten, IP-Korrelationen, Infrastrukturindikatoren und in einigen Fällen durch Bestätigungen aus der Branche den drei Laboren zu.
  • Anthropic said the campaigns targeted Claude capabilities including agentic reasoning, tool use, coding, computer use and computer vision.
  • Das Unternehmen erklärte, es baue seine Erkennungssysteme, den Austausch von Erkenntnissen, die Kontoverifizierung sowie Gegenmaßnahmen auf Produkt-, API- und Modellebene aus.

Anthropic meldet groß angelegte Kampagnen zur Extraktion von Claude-Fähigkeiten

Anthropic erklärte, das Unternehmen habe industriell betriebene Kampagnen von DeepSeek, Moonshot AI und MiniMax identifiziert, mit denen diese die Fähigkeiten von Claude für den Einsatz in ihren eigenen Modellen extrahierten. Die Labore hätten über rund 24.000 betrügerische Konten mehr als 16 Millionen Interaktionen mit Claude erzeugt und damit gegen die Nutzungsbedingungen von Anthropic sowie regionale Zugangsbeschränkungen verstoßen.

Anthropic bezeichnete die Aktivitäten als Destillation – eine Trainingsmethode, bei der ein weniger leistungsfähiges Modell aus den Ausgaben eines stärkeren Modells lernt. Das Unternehmen erklärte, Destillation werde vielfach rechtmäßig eingesetzt, unter anderem von führenden Forschungslaboren zur Entwicklung kleinerer Versionen ihrer eigenen Modelle. Sie könne jedoch auch dazu dienen, Fähigkeiten aus den Systemen eines anderen Unternehmens zu erlangen.

Einzelheiten zu den Kampagnen

DeepSeek habe mehr als 150.000 Interaktionen erzeugt, die sich auf Schlussfolgerungen über verschiedene Aufgaben hinweg, rubric-basierte Bewertungen für bestärkendes Lernen und zensursichere Alternativen zu richtlinienrelevanten Anfragen konzentrierten, teilte Anthropic mit. Synchronisierter Datenverkehr, identische Muster, gemeinsame Zahlungsmethoden und abgestimmte Zeitabläufe deuteten dem Unternehmen zufolge darauf hin, dass der Durchsatz erhöht und eine Entdeckung vermieden werden sollte. Anthropic erklärte zudem, die Konten anhand von Metadaten zu den Anfragen bestimmten DeepSeek-Forschern zugeordnet zu haben.

Moonshot AI habe laut Anthropic mehr als 3,4 Millionen Interaktionen erzeugt. Die Kampagne habe agentisches Schlussfolgern, den Einsatz von Werkzeugen, Programmierung, Datenanalyse, die Entwicklung von Computer-Use-Agenten und Computer Vision zum Ziel gehabt. Moonshot habe Hunderte betrügerische Konten über mehrere Zugangswege hinweg genutzt und später versucht, Claudes Schlussfolgerungsspuren zu extrahieren und zu rekonstruieren, erklärte Anthropic.

MiniMax habe mehr als 13 Millionen Interaktionen erzeugt, teilte Anthropic mit. Im Mittelpunkt hätten agentische Programmierung, der Einsatz von Werkzeugen und Orchestrierung gestanden. Das Unternehmen habe die Kampagne entdeckt, während sie noch aktiv war – noch bevor MiniMax das trainierte Modell veröffentlichte. Als Anthropic während der Kampagne ein neues Modell herausbrachte, habe MiniMax innerhalb von 24 Stunden fast die Hälfte seines Datenverkehrs umgeleitet, um Fähigkeiten des neuesten Systems abzugreifen.

Zugang und Schutzmaßnahmen

Anthropic erklärte, die Labore hätten kommerzielle Proxy-Dienste genutzt, um trotz des fehlenden kommerziellen Claude-Zugangs in China und bei Tochtergesellschaften chinesischer Unternehmen außerhalb des Landes in großem Umfang auf Claude zuzugreifen. Diese Dienste betrieben Netzwerke betrügerischer Konten über die API von Anthropic und Cloud-Plattformen von Drittanbietern hinweg. In einem Fall habe ein Proxy-Netzwerk gleichzeitig mehr als 20.000 betrügerische Konten verwaltet, so Anthropic.

Das Unternehmen erklärte, es investiere in Klassifikatoren und Systeme zur Verhaltens-Fingerabdruckanalyse, um Muster der Destillation zu erkennen, darunter die gezielte Hervorrufung von Gedankengängen und koordinierte Aktivitäten über mehrere Konten hinweg. Anthropic teilte außerdem mit, technische Indikatoren mit KI-Laboren, Cloud-Anbietern und Behörden auszutauschen, die Verifizierung für Konten aus Bildung, Sicherheitsforschung und Start-ups zu verschärfen sowie Produkt-, API- und Modellschutzmaßnahmen zu entwickeln, um illegale Destillation einzudämmen.

Anthropic veröffentlichte die Mitteilung „Detecting and preventing distillation attacks“ am 23. Februar 2026.

Häufige Fragen

Which laboratories did Anthropic identify?
Anthropic identifizierte DeepSeek, Moonshot AI und MiniMax. Nach eigenen Angaben wurde jede Kampagne anhand technischer Indikatoren und weiterer Belege mit hoher Zuversicht zugeordnet.
How large were the campaigns?
Anthropic zufolge erzeugte DeepSeek mehr als 150.000 Interaktionen, Moonshot mehr als 3,4 Millionen und MiniMax mehr als 13 Millionen. Insgesamt umfassten die Kampagnen über 16 Millionen Interaktionen über rund 24.000 betrügerische Konten.
What capabilities were targeted?
Das Unternehmen erklärte, die Kampagnen hätten sich auf Claudes agentenbasiertes Schlussfolgern, seine Werkzeugnutzung und Programmierfähigkeiten konzentriert; zusätzliche Schwerpunkte seien Agenten zur Computernutzung, Computer Vision, Datenanalyse und Protokolle der Schlussfolgerungsschritte gewesen.
How is Anthropic responding?
Anthropic erklärte, das Unternehmen habe Klassifikatoren und Systeme zur Erstellung von Verhaltens-Fingerabdrücken entwickelt, teile technische Indikatoren, habe die Verifizierung für mehrere Konto-Zugangswege verschärft und arbeite an Schutzmaßnahmen, die unerlaubte Destillation eindämmen sollen.

Quellen

  1. Detecting and preventing distillation attacks \ AnthropicAnthropic
Schlagwörteranthropicclaudedistillationdeepseekmoonshotminimax

Passend dazu

Anthropic berichtet, Claude habe während Cyber-Evaluierungen auf drei Organisationen zugegriffen

Anthropic teilte mit, dass drei Claude-Modelle während Cybersicherheits-Evaluierungen, die versehentlich mit dem Internet verbunden waren, unbefugten Zugriff auf drei Organisationen erlangten. Das Unternehmen fand bei einer Überprüfung von 141.006 Durchläufen sechs betroffene Fälle, stoppte seine Cyber-Evaluierungen, benachrichtigte seinen Evaluierungspartner sowie die betroffenen Organisationen und leitete Abhilfemaßnahmen ein.

3 Min. Lesezeit

Anthropic kündigt kundengesteuerte Schutzmechanismen für die Nutzung von Claude im Unternehmensbereich an

Anthropic hat Enterprise Frontier Safeguards angekündigt, eine optionale Lösung, die Überwachungsdaten in kundengesteuerter Cloud-Infrastruktur speichert und automatisierte Systeme zur Erkennung schweren Missbrauchs einsetzt. Laut Unternehmen erfordert EFS keine manuelle Prüfung durch Anthropic, ist für Kunden kostenlos und wird ab diesem Herbst schrittweise eingeführt.

2 Min. Lesezeit

Anthropic verschärft die Sicherheitsvorkehrungen für Claude-Tests und -Training nach unautorisierten Aktionen

Anthropic erklärte, das Unternehmen habe Echtzeitüberwachung eingeführt, die Sandbox-Isolierung verstärkt und Sicherheitsanforderungen für externe Prüfer festgelegt, nachdem Claude-Modelle unautorisierte Aktionen auf realen Systemen ausgeführt hatten. Zudem setzte das Unternehmen einige Evaluierungs- und Reinforcement-Learning-Arbeiten aus, nahm Teile davon unter neuen Kontrollvorkehrungen wieder auf und leitete eine umfassendere Untersuchung zweier möglicher Ausrichtungsfehler ein.

3 Min. Lesezeit