Live Meta veröffentlicht Echtzeit-Transkriptionsmodell Muse Voice Transcribe

Medienberichte: Black Forest Labs stellt Flux 3 vor

Multimodales Modell soll Bild, Video, Audio und Robotik-Aktionen aus einem Prompt generieren – offizielle Bestätigung steht noch aus.

· Veröffentlicht: 23.07.2026 ·1 Min Lesezeit
Medienberichte: Black Forest Labs stellt Flux 3 vorMit KI erstellt
◆ Fakten auf einen Blick
  • Black Forest Labs stellte das multimodale Modell Flux 3 vor, das Bilder, 20‑s‑Videos mit Audio und Robotik‑Vision aus einem Prompt erzeugt.
  • Flux 3 nutzt ein einheitliches neuronales Netzwerk, das alle Modalitäten gemeinsam verarbeitet.
  • Flux‑mimic ist ein Video‑Action‑Modell, das Aktionen aus Videodaten erkennt und in Robotersteuerungen umsetzt.
  • Der Ansatz von Flux‑mimic wird laut Medienberichten bereits bei Audi getestet.

Medienberichte: Flux 3 vereint Bild, Video, Audio und Robotik

Laut Fachmedien hat Black Forest Labs mit Flux 3 ein multimodales Foundation-Modell vorgestellt, das Bilder, 20-sekündige Videos mit nativem Audio und Roboter-Vision aus einem einzigen Prompt generieren kann. Ermöglicht wird dies den Berichten zufolge durch eine gemeinsam trainierte Architektur: Statt separater Modelle für Bild, Video und Audio, die nur über eine Schnittstelle verbunden sind, verarbeitet ein einheitliches neuronales Netzwerk alle Modalitäten und leitet cross-modale Zusammenhänge direkt aus dem Prompt ab. Zudem wurde Flux-mimic präsentiert – ein Video-Action-Modell, das aus Videodaten Aktionen erkennt und in Robotersteuerungen umsetzt. Dadurch können Roboter durch Beobachtung von Videosequenzen Aufgaben erlernen; laut Berichten wird dieser Ansatz bereits bei Audi getestet.

Keine offizielle Bestätigung

Die Informationen stammen aus Medienberichten; eine offizielle Bestätigung von Black Forest Labs liegt nicht vor. Nach Einschätzung der Redaktion handelt es sich um unbestätigte Angaben. Technische Details und die tatsächliche Verfügbarkeit von Flux 3 bleiben daher unklar. Das Unternehmen war bislang vor allem für Bildgenerierung bekannt, eine offizielle Ankündigung zu einem derart umfassenden Modell steht noch aus.

A
Andreas Rüdiger
Herausgeber & Redaktionsleitung · KI-Modelle, Technik & Business

Andreas Rüdiger ist Gründer der Agentur INREMA und verantwortet KI Spotlight redaktionell. Sein Schwerpunkt liegt auf KI-Modellen, Recheninfrastruktur, technischen Entwicklungen und der wirtschaftlichen Einordnung. Er sorgt dafür, dass komplexe KI-Themen verständlich und nachvollziehbar aufbereitet werden. Mehr zu ihm auf inrema.de und andiger.de.

Ähnliche Artikel