Live ChatGPT verweigert Tool-Calls für app-only MCP-Tools

Forschung

Neue Modelle, Papers und Durchbrüche aus der KI-Forschung.

Reddit-Zitate in ChatGPT Search brechen einMit KI erstellt
Forschung

Reddit-Zitate in ChatGPT Search brechen ein

Promptwatch misst 86,4 Prozent relativen Rückgang

gestern
Station: Offene Multi-Agenten-Umgebung für mathematische EntdeckungenMit KI erstellt
Forschung

Station: Offene Multi-Agenten-Umgebung für mathematische Entdeckungen

Neue Ergebnisse in Konstruktionsproblemen – doch die technische Umsetzung der Kollaboration bleibt im Abstract offen

gestern
Studie vergleicht DeepL und zwei Gemini-Varianten für Felskunst-ÜbersetzungMit KI erstellt
Forschung

Studie vergleicht DeepL und zwei Gemini-Varianten für Felskunst-Übersetzung

Ein Vergleich von DeepL, Gemini-Simple und Gemini-RAG für die Übersetzung eines spanischen akademischen Felskunst-Textes

gestern
LangChain: Observability braucht Feedback-Signale für LernfähigkeitMit KI erstellt
Forschung

LangChain: Observability braucht Feedback-Signale für Lernfähigkeit

LangChain fordert Feedback-Signale als Grundlage für lernende Agentensysteme

26.08.2026
Columbia-Studie: KI-Schwächen bei Intelligenztests trotz Puzzle-FortschrittenMit KI erstellt
Forschung

Columbia-Studie: KI-Schwächen bei Intelligenztests trotz Puzzle-Fortschritten

MIT Technology Review berichtet über Ende-2024-Studie, die erhebliche Defizite moderner KI-Modelle aufzeigt

26.08.2026
Blinde Abstimmung: Gemini ist beliebteste KI für College-EssaysMit KI erstellt
Forschung

Blinde Abstimmung: Gemini ist beliebteste KI für College-Essays

StudyArena analysiert 6.851 blinde Studentenstimmen – Gemini liegt mit 39,6 Prozent vorn.

26.08.2026
QAH: Neues Verfahren repariert 4-Bit-LLMs schneller und stabilerMit KI erstellt
Forschung

QAH: Neues Verfahren repariert 4-Bit-LLMs schneller und stabiler

Quantization-Aware Healing destilliert direkt vom unkomprimierten Originalmodell und macht komprimierte 4-Bit-LLMs wieder fit für den Einsatz.

26.08.2026
LangChain stellt Multi-Agenten-Modell 'Agentic Engineering' vorMit KI erstellt
Forschung

LangChain stellt Multi-Agenten-Modell 'Agentic Engineering' vor

Neues Koordinationsmodell soll Software durch die gesamte Lieferpipeline bewegen – erste Pilotdaten zeigen schnellere Debugging-Ursachenfindung

25.08.2026
ERPO ersetzt aktionsseitige Policy-KL durch eingangsseitige KontrolleMit KI erstellt
Forschung

ERPO ersetzt aktionsseitige Policy-KL durch eingangsseitige Kontrolle

Neues Verfahren verlagert Regularisierung für Reinforcement Learning großer Sprachmodelle auf die Eingangsseite.

25.08.2026
Eine verschmutzte Webseite genügt, um LLM-Recommender zu täuschenMit KI erstellt
Forschung

Eine verschmutzte Webseite genügt, um LLM-Recommender zu täuschen

Studie zeigt: Such-augmentierte LLM-Recommender sind hochgradig anfällig für GEO-manipulierte Web-Inhalte.

25.08.2026
Studie: KI-Agenten können nicht frei forschenMit KI erstellt
Forschung

Studie: KI-Agenten können nicht frei forschen

Autonome KI-Agenten können bislang nicht frei forschen

25.08.2026
Kritischer Review zu Hadith-Computational-Science und LLMs erschienenMit KI erstellt
Forschung

Kritischer Review zu Hadith-Computational-Science und LLMs erschienen

Neuer Review untersucht, wie Transformer-Modelle, retrieval-gestützte Pipelines und Large Language Models die Hadith-Forschung verändern – und bewertet diese Entwicklung kritisch.

24.08.2026