OpenAI Agents SDK: Subagent-Calls via as_tool() umgehen Prompt-Cache
Nutzerberichte zeigen 0% Cache-Treffer trotz korrekter Schlüssel – Dokumentation und Praxis klaffen auseinander.
Mit KI erstellt◆ Fakten auf einen Blick
- Bei Verwendung von Agent.as_tool() für Subagenten im OpenAI Agents SDK werden keine Prompt-Cache-Treffer erzielt, selbst wenn die Anfragen byte-identisch sind und der prompt_cache_key korrekt gesetzt ist.
- Im Agents SDK werden Prompts mit mehr als 1024 Tokens nicht im Prompt-Cache gespeichert; cached_tokens fehlen in der Usage.
- Das Agent SDK weist mehrere undokumentierte Verhaltensweisen beim Prompt-Caching auf, darunter zufällige UUIDs in Tool-Beschreibungen, die den Cache invalidieren, eine Standard-TTL von 1 Stunde statt 5 Minuten und eine cache_control-Platzierung, die zu 400-Fehlern führen kann.
- Prompt-Caching basiert auf exakter Übereinstimmung des Prefix; bereits ein einzelner Zeichenunterschied führt zu einem vollständigen Cache-Miss.
- Laut offizieller OpenAI-Dokumentation ist Prompt-Caching standardmäßig aktiviert und die Agents API nutzt das gleiche Caching-Verhalten wie die Responses API; die Wiederverwendung von Kontext in einer Session kann einen gemeinsamen Prefix bewahren, garantiert aber keinen Cache-Treffer.
Subagent-Calls via as_tool() erzielen keine Cache-Treffer
Bei Verwendung von Agent.as_tool() für Subagenten im OpenAI Agents SDK werden laut Nutzerberichten keine Prompt-Cache-Treffer erzielt, selbst wenn die Anfragen byte-identisch sind und der prompt_cache_key korrekt gesetzt ist. Ein Nutzer dokumentierte 42 Aufrufe mit einer Trefferquote von 0 Prozent. Das führt zu höheren Kosten und Latenz, da der Cache nie genutzt wird. Ursache könnten undokumentierte Verhaltensweisen wie zufällige UUIDs in Tool-Beschreibungen sein, die den Prefix verändern, oder eine abweichende TTL, die den Cache vorzeitig invalidiert.
Dokumentation verspricht Caching, Praxis zeigt 0% Trefferquote
Die offizielle OpenAI-Dokumentation verspricht, dass Prompt-Caching standardmäßig aktiviert ist und die Agents API das gleiche Caching-Verhalten wie die Responses API nutzt. Die Praxis zeigt jedoch bei as_tool() keine Cache-Treffer. Zusätzlich weist das SDK undokumentierte Verhaltensweisen auf, die den Cache beeinträchtigen können, etwa zufällige UUIDs in Tool-Beschreibungen oder eine Standard-TTL von einer Stunde statt fünf Minuten. Zufällige UUIDs ändern den Prompt-Prefix und invalidieren dadurch den Cache, während die abweichende TTL zu höheren Kosten führt, da Cache-Writes teurer sind und der Cache seltener genutzt wird.



