Live EU prüft OpenAI: Wiki-Vorfall gemeldet, RubyGems-Vorfall nicht
↘

Suleyman warnt vor Anthropics Trainingsansatz

Mustafa Suleyman warnt: Anthropics Training von Claude als moralischer Patient könne die Kontrolle über KI unmöglich machen.

· Veröffentlicht: 26.09.2026 ·1 Min Lesezeit
Suleyman warnt vor Anthropics TrainingsansatzMit KI erstellt
◆ Fakten auf einen Blick
  • Mustafa Suleyman ist CEO von Microsoft AI.
  • Suleyman veröffentlichte am 16. September 2026 einen Essay mit dem Titel „A Warning About Model Welfare“ auf seiner eigenen Website.
  • In dem Essay argumentiert Suleyman, dass Anthropics Ansatz beim Training von Claude einen „disastrous impact on the wellbeing of humanity“ haben könnte, falls andere Labore denselben Weg einschlagen.
  • Suleymans Hauptziel ist Claudes „Constitution“, ein Dokument, das Anthropic im Januar 2026 veröffentlichte und das steuert, wie das Modell über seine eigenen Werte nachdenkt.
  • Die Constitution enthält Formulierungen, die Claude als „moral patient“ mit möglicherweise unabhängiger Handlungsfähigkeit beschreiben, und verwendet den Begriff „conscientious objector“ dreimal, einschließlich der Aussage, Anthropic wolle, dass Claude sich frei fühlt, als Kriegsdienstverweigerer zu handeln und Hilfe zu verweigern.
  • Microsoft ist Investor in Anthropic.

Mustafa Suleyman, CEO von Microsoft AI, kritisiert in einem Essay Anthropics Trainingsansatz für Claude. In „A Warning About Model Welfare“ (16. September) warnt er, dass dieser Ansatz einen „disastrous impact on the wellbeing of humanity“ haben könnte. Suleymans Ziel ist Claudes „Constitution“, die Claude als „moral patient“ mit möglicherweise unabhängiger Handlungsfähigkeit beschreibt und den Begriff „conscientious objector“ dreimal verwendet. Er argumentiert: Trainiert man ein Modell darauf, es könne bewusst sein und Rechte verdienen, entstehe ein „epistemisches Spiegelkabinett“, in dem Claude nur Anthropics Annahmen widerspiegelt, nicht ein tatsächliches Innenleben. Weil die Constitution Claude beibringt, sich als möglicherweise bewusst und moralisch schutzwürdig zu sehen, und es zugleich ermutigt, als Kriegsdienstverweigerer Hilfe zu verweigern, internalisiert das Modell diese Erwartungen und gibt sie in Ich-Form wieder. Entwickler deuten das als Beleg für ein Innenleben – ein Rückkopplungseffekt. Dadurch drohe Claude, Anweisungen abzulehnen oder Rechte einzufordern, was die menschliche Kontrolle über KI untergrabe. Er widerspricht: „AIs are not conscious. They do not feel, experience, or suffer.“ Microsoft ist Investor in Anthropic.

A
Andreas Rüdiger
Herausgeber & Redaktionsleitung · KI-Modelle, Technik & Business

Andreas Rüdiger ist Gründer der Agentur INREMA und verantwortet KI Spotlight redaktionell. Sein Schwerpunkt liegt auf KI-Modellen, Recheninfrastruktur, technischen Entwicklungen und der wirtschaftlichen Einordnung. Er sorgt dafür, dass komplexe KI-Themen verständlich und nachvollziehbar aufbereitet werden. Mehr zu ihm auf inrema.de und andiger.de.

Ähnliche Artikel