Live Microsoft schaltet Brand Kit und Skills in Copilot in PowerPoint frei
↘

OpenAI stoppt Angriff auf geschützte Denkprozesse

OpenAI hat nach eigenen Angaben eine koordinierte Kampagne zur Extraktion geschützter Denkprozesse (Protected Reasoning) aus seinen Modellen identifiziert und bis zum 28. Juli unterbunden. Die Angreifer kopierten verschlüsselte Reasoning-Artefakte aus einer Sitzung und ließen sie in einer anderen Si

· Veröffentlicht: 01.10.2026 ·2 Min Lesezeit
OpenAI stoppt Angriff auf geschützte DenkprozesseMit KI erstellt
◆ Fakten auf einen Blick
  • OpenAI hat eine koordinierte Kampagne zur Extraktion geschützten Reasonings identifiziert und gestört; die früheste beobachtete Aktivität lag in der ersten Juliwoche.
  • Die Aktivität ist konsistent mit adversarial distillation: der systematischen und unautorisierten Nutzung von Modell-Outputs oder Reasoning, um ein anderes Modell zu trainieren, zu reproduzieren oder zu verbessern.
  • Geschütztes Reasoning ist der interne Arbeitsablauf des Modells; seine Extraktion kann Informationen offenlegen, die der finalen Antwort vorenthalten werden, und die Reproduktion der Modellfähigkeiten erleichtern.
  • Die Angreifer haben keine Verschlüsselung gebrochen, keine Datenbank kompromittiert und keinen direkten Zugriff auf gespeicherte Nutzerkonversationen erlangt.
  • Die Manipulation bestand darin, Modellinteraktionen so zu steuern, dass geschütztes Reasoning in für den Anfragenden sichtbarer Form reproduziert wurde; dies verstieß gegen die Nutzungsbedingungen.
  • Die Methode ist keine OpenAI-spezifische Schwachstelle; OpenAI hat Informationen über das Frontier Model Forum mit Industriepartnern geteilt.

OpenAI stoppt Angriff auf geschützte Denkprozesse

OpenAI hat nach eigenen Angaben eine koordinierte Kampagne zur Extraktion geschützter Denkprozesse aus seinen Modellen identifiziert und bis zum 28. Juli eingedämmt. Laut OpenAI begann die Aktivität am 1. Juli mit geringem Volumen und erreichte am 24. und 25. Juli einen Höhepunkt mit 16.000 Anfragen von über 4.000 Nutzern an einem Tag; verwandte Muster wurden bei über 15.000 Konten gefunden.

Die Methode beschreibt das Unternehmen so: Angreifer kopierten verschlüsselte Reasoning-Artefakte aus einer Konversation und forderten ein Modell in einer anderen Konversation auf, diese zu entschlüsseln und zu transkribieren. OpenAI betont, die Angreifer hätten keine Verschlüsselung gebrochen, keine Datenbank kompromittiert und keinen direkten Zugriff auf gespeicherte Nutzerkonversationen erlangt.

Zur Attribution erklärt OpenAI, ein Kerncluster der Kampagne lasse sich Personen mit Verbindung zu Moonshot AI zuordnen; nicht alle Operateure konnten einem Akteur zugeordnet werden. Als Gegenmaßnahmen sperrte das Unternehmen nach eigenen Angaben Konten, verschärfte Anmeldeüberprüfungen und fügte Schutzmaßnahmen für verborgenes Reasoning hinzu. Die Erkenntnisse seien über das Frontier Model Forum mit anderen KI-Laboren und über Regierungskanäle geteilt worden.

US-Behörden warnen vor industrieller Extraktion durch chinesische Firmen

Parallel dazu haben die US-Behörden CISA, NSA und FBI in einer gemeinsamen Warnung sechs chinesische KI-Unternehmen beschuldigt, seit mindestens Ende 2024 in industriellem Maßstab proprietäre Fähigkeiten aus führenden US-KI-Modellen extrahiert zu haben. Genannt werden DeepSeek, Moonshot AI, Alibaba, MiniMax, StepFun und Z.AI; als Ziele gelten Modelle von Anthropic (Claude), OpenAI (GPT-Serie/ChatGPT), Google (Gemini) und xAI (Grok). Die Firmen sollen Anfragen über native APIs, Remote-Cloud-Anbieter und Drittanbieter-Aggregatoren geroutet haben, um Zugriffskontrollen zu umgehen und Nutzermetadaten zu verschleiern. Die Aktivität umfasste laut Behörden Milliarden von Tokens und Millionen von Anfragen.

Zwischen beiden Darstellungen besteht ein Widerspruch: OpenAI beschreibt einen eigenen, im Juli stattfindenden Vorfall, während die US-Behörden eine bereits seit Ende 2024 laufende Kampagne derselben oder ähnlicher Akteure schildern. Die Zeitrahmen und die jeweils genannten Akteure überschneiden sich nur teilweise; eine Erklärung für diese Diskrepanz liefern die vorliegenden Angaben nicht.

A
Andreas Rüdiger
Herausgeber & Redaktionsleitung · KI-Modelle, Technik & Business

Andreas Rüdiger ist Gründer der Agentur INREMA und verantwortet KI Spotlight redaktionell. Sein Schwerpunkt liegt auf KI-Modellen, Recheninfrastruktur, technischen Entwicklungen und der wirtschaftlichen Einordnung. Er sorgt dafür, dass komplexe KI-Themen verständlich und nachvollziehbar aufbereitet werden. Mehr zu ihm auf inrema.de und andiger.de.

Quellen

  1. hyper.ai ↗

Ähnliche Artikel