用 OpenAI API 做 Agent,先检查两处,可能比继续调 Prompt 更有用。
下一轮带上 previous_response_id,别把每次 tool call 当成新对话。模型才能接着前面的 reasoning 继续。
长任务别直接删老消息。配 context_management 和 compact_threshold,或调用 responses.compact()。
压缩结果原样传回,不要自己改写。
OpenAI 只改这两处,GPT-5.6 Sol 的 ARC-AGI-3 分数就从 13.3% 涨到 38.3%,输出 token 降到约 1/6。
Agent 表现差,先查运行框架有没有让它失忆,再考虑换模型。原文:
顯示更多