Anthropic: Drei KI-Labore nutzten betrügerische Konten zur Destillation von Claude
Anthropic says DeepSeek, Moonshot and MiniMax generated more than 16 million Claude exchanges through about 24,000 fraudulent accounts.
Kurze Antwort
Was hat Anthropic zu Destillationsangriffen gegen Claude angekündigt?
Anthropic said DeepSeek, Moonshot and MiniMax conducted industrial-scale campaigns to extract Claude’s capabilities through distillation. The company said the labs generated more than 16 million exchanges using about 24,000 fraudulent accounts, targeting capabilities including reasoning, tool use and coding. Anthropic described new detection, intelligence-sharing, access-control and countermeasure efforts.
Das Wichtigste
- Anthropic said DeepSeek, Moonshot and MiniMax used fraudulent accounts and proxy services to generate more than 16 million exchanges with Claude.
- Das Unternehmen ordnete die Kampagnen anhand von Anfragemetadaten, IP-Korrelationen, Infrastrukturindikatoren und in einigen Fällen durch Bestätigungen aus der Branche den drei Laboren zu.
- Anthropic said the campaigns targeted Claude capabilities including agentic reasoning, tool use, coding, computer use and computer vision.
- Das Unternehmen erklärte, es baue seine Erkennungssysteme, den Austausch von Erkenntnissen, die Kontoverifizierung sowie Gegenmaßnahmen auf Produkt-, API- und Modellebene aus.
Anthropic meldet groß angelegte Kampagnen zur Extraktion von Claude-Fähigkeiten
Anthropic erklärte, das Unternehmen habe industriell betriebene Kampagnen von DeepSeek, Moonshot AI und MiniMax identifiziert, mit denen diese die Fähigkeiten von Claude für den Einsatz in ihren eigenen Modellen extrahierten. Die Labore hätten über rund 24.000 betrügerische Konten mehr als 16 Millionen Interaktionen mit Claude erzeugt und damit gegen die Nutzungsbedingungen von Anthropic sowie regionale Zugangsbeschränkungen verstoßen.
Anthropic bezeichnete die Aktivitäten als Destillation – eine Trainingsmethode, bei der ein weniger leistungsfähiges Modell aus den Ausgaben eines stärkeren Modells lernt. Das Unternehmen erklärte, Destillation werde vielfach rechtmäßig eingesetzt, unter anderem von führenden Forschungslaboren zur Entwicklung kleinerer Versionen ihrer eigenen Modelle. Sie könne jedoch auch dazu dienen, Fähigkeiten aus den Systemen eines anderen Unternehmens zu erlangen.
Einzelheiten zu den Kampagnen
DeepSeek habe mehr als 150.000 Interaktionen erzeugt, die sich auf Schlussfolgerungen über verschiedene Aufgaben hinweg, rubric-basierte Bewertungen für bestärkendes Lernen und zensursichere Alternativen zu richtlinienrelevanten Anfragen konzentrierten, teilte Anthropic mit. Synchronisierter Datenverkehr, identische Muster, gemeinsame Zahlungsmethoden und abgestimmte Zeitabläufe deuteten dem Unternehmen zufolge darauf hin, dass der Durchsatz erhöht und eine Entdeckung vermieden werden sollte. Anthropic erklärte zudem, die Konten anhand von Metadaten zu den Anfragen bestimmten DeepSeek-Forschern zugeordnet zu haben.
Moonshot AI habe laut Anthropic mehr als 3,4 Millionen Interaktionen erzeugt. Die Kampagne habe agentisches Schlussfolgern, den Einsatz von Werkzeugen, Programmierung, Datenanalyse, die Entwicklung von Computer-Use-Agenten und Computer Vision zum Ziel gehabt. Moonshot habe Hunderte betrügerische Konten über mehrere Zugangswege hinweg genutzt und später versucht, Claudes Schlussfolgerungsspuren zu extrahieren und zu rekonstruieren, erklärte Anthropic.
MiniMax habe mehr als 13 Millionen Interaktionen erzeugt, teilte Anthropic mit. Im Mittelpunkt hätten agentische Programmierung, der Einsatz von Werkzeugen und Orchestrierung gestanden. Das Unternehmen habe die Kampagne entdeckt, während sie noch aktiv war – noch bevor MiniMax das trainierte Modell veröffentlichte. Als Anthropic während der Kampagne ein neues Modell herausbrachte, habe MiniMax innerhalb von 24 Stunden fast die Hälfte seines Datenverkehrs umgeleitet, um Fähigkeiten des neuesten Systems abzugreifen.
Zugang und Schutzmaßnahmen
Anthropic erklärte, die Labore hätten kommerzielle Proxy-Dienste genutzt, um trotz des fehlenden kommerziellen Claude-Zugangs in China und bei Tochtergesellschaften chinesischer Unternehmen außerhalb des Landes in großem Umfang auf Claude zuzugreifen. Diese Dienste betrieben Netzwerke betrügerischer Konten über die API von Anthropic und Cloud-Plattformen von Drittanbietern hinweg. In einem Fall habe ein Proxy-Netzwerk gleichzeitig mehr als 20.000 betrügerische Konten verwaltet, so Anthropic.
Das Unternehmen erklärte, es investiere in Klassifikatoren und Systeme zur Verhaltens-Fingerabdruckanalyse, um Muster der Destillation zu erkennen, darunter die gezielte Hervorrufung von Gedankengängen und koordinierte Aktivitäten über mehrere Konten hinweg. Anthropic teilte außerdem mit, technische Indikatoren mit KI-Laboren, Cloud-Anbietern und Behörden auszutauschen, die Verifizierung für Konten aus Bildung, Sicherheitsforschung und Start-ups zu verschärfen sowie Produkt-, API- und Modellschutzmaßnahmen zu entwickeln, um illegale Destillation einzudämmen.
Anthropic veröffentlichte die Mitteilung „Detecting and preventing distillation attacks“ am 23. Februar 2026.
Häufige Fragen
- Which laboratories did Anthropic identify?
- Anthropic identifizierte DeepSeek, Moonshot AI und MiniMax. Nach eigenen Angaben wurde jede Kampagne anhand technischer Indikatoren und weiterer Belege mit hoher Zuversicht zugeordnet.
- How large were the campaigns?
- Anthropic zufolge erzeugte DeepSeek mehr als 150.000 Interaktionen, Moonshot mehr als 3,4 Millionen und MiniMax mehr als 13 Millionen. Insgesamt umfassten die Kampagnen über 16 Millionen Interaktionen über rund 24.000 betrügerische Konten.
- What capabilities were targeted?
- Das Unternehmen erklärte, die Kampagnen hätten sich auf Claudes agentenbasiertes Schlussfolgern, seine Werkzeugnutzung und Programmierfähigkeiten konzentriert; zusätzliche Schwerpunkte seien Agenten zur Computernutzung, Computer Vision, Datenanalyse und Protokolle der Schlussfolgerungsschritte gewesen.
- How is Anthropic responding?
- Anthropic erklärte, das Unternehmen habe Klassifikatoren und Systeme zur Erstellung von Verhaltens-Fingerabdrücken entwickelt, teile technische Indikatoren, habe die Verifizierung für mehrere Konto-Zugangswege verschärft und arbeite an Schutzmaßnahmen, die unerlaubte Destillation eindämmen sollen.