Forschung
Neue Modelle, Papers und Durchbrüche aus der KI-Forschung.
Mit KI erstelltFireworks: Open-Source-Kombination übertrifft Claude Opus 4.7 bei Legal-Agent-Aufgaben
Zwei Systemtechniken mit GLM-5.1 und Kimi K2.6 erzielen höhere All-Pass-Scores auf dem Harvey-Benchmark – zu einem Bruchteil der Kosten.
Mit KI erstelltDeepSeek-V4: Programmierbare Schleifen statt fester Trainingsrezepte
Wie die Integration von Architektur, Routing und Inferenz in die Trainingsschleife die KI-Entwicklung grundlegend verändert
Mit KI erstelltHelix: VLA-Modell von Figure faltet jetzt Wäsche
Vom Logistikzentrum zum Wäschekorb: Helix beweist Vielseitigkeit
Mit KI erstelltFigure stellt Helix vor: VLA-Modell steuert humanoiden Oberkörper und ermöglicht Multi-Roboter-Kollaboration
Helix vereint Wahrnehmung, Sprachverstehen und Steuerung in einem Modell und setzt neue Maßstäbe bei der simultanen Steuerung mehrerer Roboter mit ungesehenen Objekten.
Mit KI erstelltFortschritte und Grenzen im Videoverstehen: Offene Modelle im Fokus
Aktuelle Entwicklungen treiben KI in Richtung realer Anwendungen, doch offene Modelle kämpfen mit Generalisierung, Effizienz und unvollständiger Offenheit.
Mit KI erstelltPrompt-Caching senkt Input-Kosten um bis zu 90 Prozent
Artificial Analysis zeigt: Wiederverwendung von Prompt-Teilen macht lange Kontexte wirtschaftlich – doch die Anbieter unterscheiden sich stark
Mit KI erstelltStudie stellt Nutzen automatischer Harness-Evolution für LLM-Agenten infrage
Einfache Task-Level-Suchbaselines erzielen unter gleichem Budget und auf held-out Aufgaben oft bessere Ergebnisse.
Mit KI erstelltMIT-Methode: Roboter lernen durch Vormachen und Erklären
Show-and-Tell-Ansatz ermöglicht kontextsensitives Verhalten
Mit KI erstelltFloatForm: MIT zeigt Schwarm autonomer Boote, die sich zu Strukturen verbinden
Die quadratischen Roboter navigieren selbstständig, docken magnetisch an und eröffnen neue Perspektiven für anpassungsfähige Wasserinfrastrukturen.
Mit KI erstelltBadWAM: Wenn die Kopplung von Aktion und Weltvorhersage trügt
Das Forschungspapier 'BadWAM' zeigt, dass die Sicherheitsannahme von World-Action-Modellen (WAMs) – die Kopplung von Aktionsgenerierung und Weltvorhersage – trügerisch ist. Es führt ein Framework ein, um sogenannte World-Action-Drift-Angriffe zu modellieren und zu evaluieren.
Mit KI erstelltUniVR: Neues KI-System lernt visuelles Denken, Physik und Planung aus Demonstrationen
Das System kombiniert visuelles Denken, physikalische Dynamik und Planung und nutzt das Lernverfahren VR-GRPO.
Mit KI erstelltMultiRef-Compass: Erstes Framework für die Bewertung von Multi-Referenz-Audio-Video-Generierung
Ein neues Evaluationsframework adressiert die Lücke in der Benchmark-Landschaft für multimodale Inhalte, die aus mehreren Referenzen entstehen. Konkrete Metriken und Akteure bleiben vorerst offen.