Live Richterin erklärt Pentagon-Strafen gegen Anthropic für illegal

Forschung

Neue Modelle, Papers und Durchbrüche aus der KI-Forschung.

Weitere Artikel

Neues Framework repräsentiert agentische Daten als faktorisiertes TupelMit KI erstellt
Forschung

Neues Framework repräsentiert agentische Daten als faktorisiertes Tupel

Forschung schlägt zweistufige Struktur vor: gemeinsames Datenobjekt und ACE-Linse für Verteilungsdesign

vor 10 Std
Veraltete Payer-Policy führt zur Ablehnung: Temporale RAG-Gating gegen Phantom-PoliciesMit KI erstellt
Forschung

Veraltete Payer-Policy führt zur Ablehnung: Temporale RAG-Gating gegen Phantom-Policies

Ein dokumentierter Fehlerfall zeigt, wie ein autonomer Prior-Authorization-Agent eine 2023-Richtlinie statt der 2026-Kriterien nutzte. Ein neuer Ansatz setzt auf deterministische Versions-Proxies.

vor 10 Std
Samsung-Studie belegt systematische Ghost-Autoren in KI-TextenMit KI erstellt
Forschung

Samsung-Studie belegt systematische Ghost-Autoren in KI-Texten

Preprint identifiziert modellspezifische Namens-Ensembles und 1.655 gefälschte Zenodo-Datensätze mit echten DOIs

vor 11 Std
Neuer Vokabel-Cluster dominiert 45 % der menschlichen GitHub-PRsMit KI erstellt
Forschung

Neuer Vokabel-Cluster dominiert 45 % der menschlichen GitHub-PRs

Community-Analyse identifiziert 2026 erstmals aufgetretenen Vokabel-Cluster, dessen repräsentative Wörter an Coding-Agenten erinnern.

vor 12 Std
SWE Refactor Bench: Nur 5,4 Prozent der Coding-Agent-Läufe bestehen Stack-MigrationenMit KI erstellt
Forschung

SWE Refactor Bench: Nur 5,4 Prozent der Coding-Agent-Läufe bestehen Stack-Migrationen

Neues Benchmark misst erstmals, ob Coding Agents eine Migration tatsächlich durchführen – und nicht nur Tests bestehen

gestern
Google DeepMind startet doppelblinde Bewertung für Gemini Flash LiteMit KI erstellt
Forschung

Google DeepMind startet doppelblinde Bewertung für Gemini Flash Lite

Pilotprojekt mit Singapore AI Safety Institute, OpenMined, AVERI und MLCommons soll Benchmark-Kontamination verhindern.

gestern
Datenwand ist real: 300 Billionen Token bis 2032, synthetische Daten als umstrittener AuswegMit KI erstellt
Forschung

Datenwand ist real: 300 Billionen Token bis 2032, synthetische Daten als umstrittener Ausweg

Epoch AI beziffert den verbleibenden Textbestand; Microsoft Research Asia bestätigt Skalierungsgesetze für synthetische Daten, doch Mischung und Risiken bleiben umstritten.

gestern
Ein sturer Agent genügt: Wie Multi-Agenten-Systeme kollektiv falsch liegen könnenMit KI erstellt
Forschung

Ein sturer Agent genügt: Wie Multi-Agenten-Systeme kollektiv falsch liegen können

CISPA-Studie zeigt: Ein einzelner überzeugender Agent kann eine Überzeugungskaskade auslösen – das Friedkin-Johnsen-Modell erklärt die Dynamik, drei Stellschrauben erhöhen die Sicherheit.

gestern