OpenAI bringt gpt-realtime-2.1 und gpt-realtime-2.1-mini heraus
OpenAI hat am 6. Juli 2026 die Modelle gpt-realtime-2.1 und gpt-realtime-2.1-mini veröffentlicht. Sie sollen die p95-Latenz um mindestens 25 % senken, die Sprachverarbeitung verbessern und konfigurierbares Reasoning bieten.
Mit KI erstellt◆ Fakten auf einen Blick
- OpenAI hat am 6. Juli 2026 die Modelle gpt-realtime-2.1 und gpt-realtime-2.1-mini veröffentlicht.
- Die p95‑Latenz der neuen Modelle wird durch verbessertes Caching um mindestens 25 % gesenkt.
- Alphanumerische Erkennung sowie Umgang mit Hintergrundgeräuschen und Stille wurden durch optimierte Algorithmen verbessert.
- Entwickler können den Reasoning‑Aufwand über einen Konfigurationsparameter steuern, der die Verarbeitungstiefe anpasst.
OpenAI hat am 6. Juli 2026 die Modelle gpt-realtime-2.1 und gpt-realtime-2.1-mini veröffentlicht, wie mehrere unabhängige Quellen übereinstimmend melden. Die neuen Echtzeit-Sprachmodelle senken die p95-Latenz um mindestens 25 Prozent – erreicht durch verbessertes Caching. Zudem wurden die alphanumerische Erkennung sowie der Umgang mit Hintergrundgeräuschen und Stille durch optimierte Erkennungsalgorithmen verbessert. Entwickler können den Reasoning-Aufwand über einen Konfigurationsparameter steuern, der die Verarbeitungstiefe anpasst: Höherer Aufwand liefert präzisere Ergebnisse bei längerer Latenz, niedrigerer Aufwand beschleunigt die Antwort bei reduzierter Genauigkeit. Beide Modelle unterstützen direkte Sprach-zu-Sprache-Interaktionen und Tool-Aufrufe. Das gpt-realtime-2.1-mini ist durch eine kleinere, ressourcenschonendere Architektur und geringeren Rechenaufwand deutlich günstiger: Es kostet nur etwa 0,016 US-Dollar pro Gesprächsminute, verglichen mit rund 0,05 US-Dollar beim Basismodell. Eine offizielle Ankündigung von OpenAI steht noch aus.

