Live ActObs: Beobachtungs-Token im SFT verbessern RL-Exploration

OpenAI Agents SDK: Subagent-Calls via as_tool() umgehen Prompt-Cache

Nutzerberichte zeigen 0% Cache-Treffer trotz korrekter Schlüssel – Dokumentation und Praxis klaffen auseinander.

· Veröffentlicht: 18.09.2026 ·1 Min Lesezeit
OpenAI Agents SDK: Subagent-Calls via as_tool() umgehen Prompt-CacheMit KI erstellt
◆ Fakten auf einen Blick
  • Bei Verwendung von Agent.as_tool() für Subagenten im OpenAI Agents SDK werden keine Prompt-Cache-Treffer erzielt, selbst wenn die Anfragen byte-identisch sind und der prompt_cache_key korrekt gesetzt ist.
  • Im Agents SDK werden Prompts mit mehr als 1024 Tokens nicht im Prompt-Cache gespeichert; cached_tokens fehlen in der Usage.
  • Das Agent SDK weist mehrere undokumentierte Verhaltensweisen beim Prompt-Caching auf, darunter zufällige UUIDs in Tool-Beschreibungen, die den Cache invalidieren, eine Standard-TTL von 1 Stunde statt 5 Minuten und eine cache_control-Platzierung, die zu 400-Fehlern führen kann.
  • Prompt-Caching basiert auf exakter Übereinstimmung des Prefix; bereits ein einzelner Zeichenunterschied führt zu einem vollständigen Cache-Miss.
  • Laut offizieller OpenAI-Dokumentation ist Prompt-Caching standardmäßig aktiviert und die Agents API nutzt das gleiche Caching-Verhalten wie die Responses API; die Wiederverwendung von Kontext in einer Session kann einen gemeinsamen Prefix bewahren, garantiert aber keinen Cache-Treffer.

Subagent-Calls via as_tool() erzielen keine Cache-Treffer

Bei Verwendung von Agent.as_tool() für Subagenten im OpenAI Agents SDK werden laut Nutzerberichten keine Prompt-Cache-Treffer erzielt, selbst wenn die Anfragen byte-identisch sind und der prompt_cache_key korrekt gesetzt ist. Ein Nutzer dokumentierte 42 Aufrufe mit einer Trefferquote von 0 Prozent. Das führt zu höheren Kosten und Latenz, da der Cache nie genutzt wird. Ursache könnten undokumentierte Verhaltensweisen wie zufällige UUIDs in Tool-Beschreibungen sein, die den Prefix verändern, oder eine abweichende TTL, die den Cache vorzeitig invalidiert.

Dokumentation verspricht Caching, Praxis zeigt 0% Trefferquote

Die offizielle OpenAI-Dokumentation verspricht, dass Prompt-Caching standardmäßig aktiviert ist und die Agents API das gleiche Caching-Verhalten wie die Responses API nutzt. Die Praxis zeigt jedoch bei as_tool() keine Cache-Treffer. Zusätzlich weist das SDK undokumentierte Verhaltensweisen auf, die den Cache beeinträchtigen können, etwa zufällige UUIDs in Tool-Beschreibungen oder eine Standard-TTL von einer Stunde statt fünf Minuten. Zufällige UUIDs ändern den Prompt-Prefix und invalidieren dadurch den Cache, während die abweichende TTL zu höheren Kosten führt, da Cache-Writes teurer sind und der Cache seltener genutzt wird.

J
Jasmin Freitag
Redaktion · KI-Anwendungen & Tools

Jasmin Freitag beobachtet für KI Spotlight die praktische Seite der künstlichen Intelligenz: neue Anwendungen, generative Werkzeuge, kreative KI und den Einsatz von Tools im Alltag und in Unternehmen. Sie erklärt praxisnah, was ein Werkzeug wirklich taugt.

Ähnliche Artikel