Live ChatGPT verweigert Tool-Calls für app-only MCP-Tools

Aktuelle Meldungen

888 Artikel — alle KI-Meldungen in chronologischer Reihenfolge.

DeepSeek V4 Pro: Token-Korruption und strukturelle Fehler in der PraxisMit KI erstellt
KI-Modelle

DeepSeek V4 Pro: Token-Korruption und strukturelle Fehler in der Praxis

Praxistest offenbart Token-Korruption und Artefakte, die Benchmarks nicht zeigen

19.07.2026
DeepSeek-V4: Programmierbare Schleifen statt fester TrainingsrezepteMit KI erstellt
Forschung

DeepSeek-V4: Programmierbare Schleifen statt fester Trainingsrezepte

Wie die Integration von Architektur, Routing und Inferenz in die Trainingsschleife die KI-Entwicklung grundlegend verändert

19.07.2026
LangSmith Cloud erhält Fleet-Komponente und UI-VerbesserungenMit KI erstellt
Anwendungen & Tools

LangSmith Cloud erhält Fleet-Komponente und UI-Verbesserungen

Optimierte Observability, Datasets und Evaluatoren für zuverlässigere LLM-Workflows

19.07.2026
Helix: VLA-Modell von Figure faltet jetzt WäscheMit KI erstellt
Forschung

Helix: VLA-Modell von Figure faltet jetzt Wäsche

Vom Logistikzentrum zum Wäschekorb: Helix beweist Vielseitigkeit

19.07.2026
Figure stellt Helix vor: VLA-Modell steuert humanoiden Oberkörper und ermöglicht Multi-Roboter-KollaborationMit KI erstellt
Forschung

Figure stellt Helix vor: VLA-Modell steuert humanoiden Oberkörper und ermöglicht Multi-Roboter-Kollaboration

Helix vereint Wahrnehmung, Sprachverstehen und Steuerung in einem Modell und setzt neue Maßstäbe bei der simultanen Steuerung mehrerer Roboter mit ungesehenen Objekten.

19.07.2026
Fortschritte und Grenzen im Videoverstehen: Offene Modelle im FokusMit KI erstellt
Forschung

Fortschritte und Grenzen im Videoverstehen: Offene Modelle im Fokus

Aktuelle Entwicklungen treiben KI in Richtung realer Anwendungen, doch offene Modelle kämpfen mit Generalisierung, Effizienz und unvollständiger Offenheit.

19.07.2026
Prompt-Caching senkt Input-Kosten um bis zu 90 ProzentMit KI erstellt
Forschung

Prompt-Caching senkt Input-Kosten um bis zu 90 Prozent

Artificial Analysis zeigt: Wiederverwendung von Prompt-Teilen macht lange Kontexte wirtschaftlich – doch die Anbieter unterscheiden sich stark

19.07.2026
MiniMax Hailuo präsentiert KI-generiertes Markenvideo in CannesMit KI erstellt
KI-Modelle

MiniMax Hailuo präsentiert KI-generiertes Markenvideo in Cannes

Auf dem World AI Film Festival 2026 stellte das Unternehmen ein mit eigenen multimodalen Modellen produziertes Video vor und zeigte eine Zusammenarbeit mit Stellar Pictures.

19.07.2026
EDPS- und EDPB-Trainees laden zu Konferenz über KI in der PersonalauswahlMit KI erstellt
Regulierung

EDPS- und EDPB-Trainees laden zu Konferenz über KI in der Personalauswahl

Die Trainees des EDPS und EDPB organisieren am 9. Juli 2026 eine Konferenz im Europäischen Parlament in Brüssel, die den Einsatz von KI in Rekrutierung und HR-Prozessen beleuchtet. Der Zusammenhang zum Thema „Mathematics of Data Science“ und dem CausalDS-Benchmark ist unklar.

19.07.2026
xAI verklagt erstmals Nutzer wegen CSAM-Erstellung mit GrokMit KI erstellt
KI-Modelle

xAI verklagt erstmals Nutzer wegen CSAM-Erstellung mit Grok

67-jähriger Mann aus South Carolina soll KI für nicht-einvernehmliche Bilder genutzt haben und wurde bereits verhaftet

19.07.2026
VIABench prüft KI-Assistenz mit echten Videos blinder NutzerMit KI erstellt
Anwendungen & Tools

VIABench prüft KI-Assistenz mit echten Videos blinder Nutzer

Neuer Benchmark zeigt: Multimodale Modelle scheitern noch an alltäglichen Herausforderungen

19.07.2026
SearchOS: Neues Framework für kollaborative LLM-AgentenMit KI erstellt
Anwendungen & Tools

SearchOS: Neues Framework für kollaborative LLM-Agenten

System-level Infrastruktur reduziert redundante Suchvorgänge und erhöht die Robustheit

19.07.2026
KeyFrame-Compass: Neuer Benchmark für keyframe-gesteuerte VideogenerierungMit KI erstellt
Anwendungen & Tools

KeyFrame-Compass: Neuer Benchmark für keyframe-gesteuerte Videogenerierung

KeyFrame-Compass ist ein neuer Benchmark für die Bewertung von Videogenerierungsmodellen, die mit Keyframes gesteuert werden. Er umfasst 386 kuratierte Samples und wird als erstes umfassendes Benchmark-Set dieser Art vorgestellt.

19.07.2026
Neuer Benchmark prüft Selbstwahrnehmung von DrohnenMit KI erstellt
Anwendungen & Tools

Neuer Benchmark prüft Selbstwahrnehmung von Drohnen

Das Paper „Self in Space“ adressiert eine zentrale Lücke in der Bewertung verkörperter Intelligenz von UAVs

19.07.2026
Harness Handbook: Lesbarkeit und Wartbarkeit von Agent-Harnesses verbessernMit KI erstellt
KI-Modelle

Harness Handbook: Lesbarkeit und Wartbarkeit von Agent-Harnesses verbessern

Konkrete Methoden: deklarative DSL, visuelle Graphdarstellung und strukturierte Dokumentation

19.07.2026
Studie stellt Nutzen automatischer Harness-Evolution für LLM-Agenten infrageMit KI erstellt
Forschung

Studie stellt Nutzen automatischer Harness-Evolution für LLM-Agenten infrage

Einfache Task-Level-Suchbaselines erzielen unter gleichem Budget und auf held-out Aufgaben oft bessere Ergebnisse.

19.07.2026