Live ChatGPT Voice steuert jetzt den Work-Bereich

OpenAI führt GPT-Live ein: Full-Duplex-Sprachmodell für ChatGPT

Neues Audio-Modell ermöglicht gleichzeitiges Hören und Sprechen – Rollout startet auf Web, iOS und Android

· Veröffentlicht: 24.09.2026 ·2 Min Lesezeit
OpenAI führt GPT-Live ein: Full-Duplex-Sprachmodell für ChatGPTMit KI erstellt
Inhalt
◆ Fakten auf einen Blick
  • OpenAI hat GPT-Live als neues Audio-Modell für ChatGPT eingeführt, das gleichzeitiges Hören und Sprechen ermöglicht (full-duplex).
  • Es gibt zwei Varianten: GPT-Live-1 für zahlende Pläne (Go, Plus, Pro) und GPT-Live-1 mini für Free-Nutzer.
  • GPT-Live ist auf iOS, Android und Web verfügbar.
  • Der Rollout begann am 8. Juli 2026.
  • GPT-Live kann komplexe Aufgaben an ein Frontier-Modell (GPT-5.5) delegieren, während die Konversation weiterläuft.
  • GPT-Live unterstützt anfangs kein Video, Screen Sharing, Connected Apps oder Plugins.

GPT-Live startet auf Web, iOS und Android

OpenAI hat GPT-Live eingeführt, ein neues Audio-Modell für ChatGPT, das gleichzeitiges Hören und Sprechen ermöglicht. Die als full-duplex bezeichnete Architektur erlaubt es dem Modell, Eingaben zu verarbeiten, während es Ausgaben generiert – statt wie bisher auf das Ende eines Redebeitrags zu warten. Das System kann entscheiden, ob es spricht, weiter zuhört, pausiert oder unterbricht. Der Rollout begann am 8. Juli 2026 und umfasst die Plattformen Web, iOS und Android. Nach Angaben von OpenAI nutzen mehr als 150 Millionen Menschen wöchentlich die Sprach- und Diktierfunktionen von ChatGPT. In einer Mitteilung auf LinkedIn bezeichnete OpenAI GPT-Live als „unser bisher intelligentestes Sprachmodell“.

Zwei Modellvarianten für Free- und Paid-Nutzer

Für die Nutzung stehen zwei Modellvarianten bereit. GPT-Live-1 wird als Standard für zahlende Abos der Stufen Go, Plus und Pro eingesetzt, GPT-Live-1 mini für Konten im Free-Tarif. Beide Varianten sind in den bestehenden Abonnements enthalten; zusätzliche Kosten entstehen für Endnutzer nicht. Eine zentrale Neuerung ist die Fähigkeit zur Delegation: Bei Fragen, die Websuche, tiefergehende Schlussfolgerungen oder komplexere Arbeiten erfordern, übergibt GPT-Live die Aufgabe im Hintergrund an das Frontier-Modell GPT-5.5. Die Delegation erfolgt automatisch: Das System entscheidet, ob eine Anfrage die Kapazität des Sprachmodells übersteigt und an das leistungsfähigere Modell weitergereicht werden muss. Während dieses Modell arbeitet, kann die Sprachkonversation weiterlaufen; das Ergebnis wird anschließend in das Gespräch zurückgeführt. Nach Angaben von OpenAI soll das im Hintergrund genutzte Modell künftig mit jeder neuen Frontier-Generation aktualisiert werden. Zum Start ist GPT-5.5 gesetzt.

Einschränkungen und unklarer API-Zugang

Zum Start sind mehrere Funktionen nicht verfügbar. GPT-Live unterstützt anfangs kein Video, kein Screen Sharing, keine Connected Apps und keine Plugins. Die API-Verfügbarkeit wird widersprüchlich kommuniziert. Die Entwicklerdokumentation von OpenAI beschreibt, dass GPT-Live-1 in API-Requests verwendet werden kann; Backend-Antworten werden demnach nach den normalen Preisen des konfigurierten Modells abgerechnet. Andere Quellen berichten dagegen, Entwickler und Unternehmen erhielten zum Start keinen API-Zugang. GPT-Live solle später über die Schnittstelle verfügbar sein; ein Anmeldeformular für Benachrichtigungen sei bereits eingerichtet. Für Entwickler, die auf einen API-Zugang warten, bleibt damit unklar, wann sie GPT-Live in eigene Anwendungen integrieren können. Die fehlenden Funktionen schränken die Einsatzmöglichkeiten zunächst ein, insbesondere für Szenarien, die visuelle Eingaben oder die Anbindung an Drittanbieter-Dienste erfordern. OpenAI selbst hat den Widerspruch bislang nicht aufgelöst.

A
Andreas Rüdiger
Herausgeber & Redaktionsleitung · KI-Modelle, Technik & Business

Andreas Rüdiger ist Gründer der Agentur INREMA und verantwortet KI Spotlight redaktionell. Sein Schwerpunkt liegt auf KI-Modellen, Recheninfrastruktur, technischen Entwicklungen und der wirtschaftlichen Einordnung. Er sorgt dafür, dass komplexe KI-Themen verständlich und nachvollziehbar aufbereitet werden. Mehr zu ihm auf inrema.de und andiger.de.

Ähnliche Artikel