🧵 TL;DR: 長く走るAIエージェントはトークンコストが膨らみがち。Deep Agents はプロンプトキャッシュを"設定不要"で効かせ、実タスクで最大80%のコスト削減を実現します。
タイトル: Prompt Caching with Deep Agents
URL:
ポイント
💸 毎リクエストで会話履歴・システムプロンプト・ツール定義を再処理してコストが積み上がるのが課題
⚡ プロンプトキャッシュは静的部分の計算結果を再利用し、新規の差分だけを処理
🧩 明示的なキャッシュ区切り(breakpoint)で、プロンプトが少し変わっても部分ヒットを維持
🤖 Deep Agents は3戦略を自動適用(明示breakpoint/プロバイダ側の暗黙キャッシュ/キャッシュ最大化の構造化)
📊 実測でClaude Haiku 4.5は-77%、GPT-5.4-miniは-80%、Gemini 3.5-Flashは-49%
🔭 LangSmith でキャッシュ読み取りトークンを可視化し、削減を計測・最適化
⏳ 会話が長いほど効果増。短いタスクでは恩恵は小さい
設定ゼロでプロバイダ差を吸収してくれる点が、実運用で効いてきそうです。
#
LangChain# #
AIエージェント#