Article

Codex auf AWS Bedrock: Cache-Bug verursacht 10x Kosten

OpenAI Codex AWS Bedrock GPT-5.6 Prompt-Caching Kosten

Codex CLI ohne Cache-Controls auf Bedrock

Ein GitHub-Issue im OpenAI Codex Repo (#37674) offenbart ein teures Problem: Die native AWS Bedrock-Integration von Codex CLI unterstützt kein explizites Prompt-Caching für GPT-5.6 Sol. Das Ergebnis? Cache-Writes machen 85% der Modellkosten aus — bei einem User wurden $1.182 allein für Cache-Writes in vier Tagen geschätzt, bei einer Gesamtrechnung von $1.386.

Was genau passiert

Codex CLI sendet zwar einen prompt_cache_key, aber die Request-Body enthält weder prompt_cache_options noch prompt_cache_breakpoint. AWS dokumentiert explizit Cache-Modi für GPT-5.6 auf Bedrock — besonders für agentic Workflows mit langen stabilen Instruktionen und Tool-Definitionen. Genau solch ein Workload läuft in Codex. Aber der native Bedrock-Provider kann das nicht konfigurieren, und config.toml bietet auch keine Lösung.

Upgrade verschlimmert es

Ein weiterer User berichtet: Nach dem Upgrade von Codex 0.146.0 auf 0.147.0 stieg das Cache-Write-to-Read-Verhältnis von 0,08 auf 8,84 — die Tageskosten vervielfachten sich. Ein Rollback auf 0.146.0 brachte das Verhältnis sofort auf 0,025 zurück bei 97% Cache-Read-Rate. Verdächtigt wird, dass Remote-Compaction den Prompt-Cache invalidiert.

Fazit

Wer Codex CLI mit AWS Bedrock nutzt, sollte Version 0.147.0 meiden oder seine Cost-Explorer-Daten genau beobachten. Bis OpenAI die fehlenden Cache-Controls nachreicht, bleibt das ein teures Problem.