Agent 相关词汇
Token 计费单位。
大概一个汉字 1–2 个 token,一个英文单词约 1 个。所有价格都按 token 算。
上下文窗口(context window)
一次调用最多能塞多少 token。比如「1M 上下文」就是最多塞 100 万 token。
工具调用(tool call)
模型不能执行任何东西。它只会吐文字。所以当它要执行命令时,它其实是"说"了一句:「我想执行 ls -la」。
然后是 harness 接住这句话,真的去你机器上执行,把结果贴回对话里,再连同全部历史发给模型。
这一来一回叫一次 tool call。模型负责说,harness 负责做。
Schema(工具说明书)
告诉模型「你有哪些工具可用、每个工具要什么参数」。这份说明书就叫 schema。
Agent Loop(智能体循环)
把上面那个过程转起来:
发请求(全部历史 + 工具说明书) → 模型说「我要调 X 工具」 → harness 真的执行 X → 结果贴回历史 → 再发请求(历史又长了一截) → ...循环,直到模型说「做完了」
这个循环就是 agent 的本体。
压缩(compaction)
对话太长,超过上下文窗口了,就得把老内容摘要掉腾地方。
代价是:前缀变了,缓存归零。
reasoning_content(思考内容)
推理模型回答前会先"想"一大段。这段思考通常直接被丢掉。
MCP
一个统一接口标准,让第三方工具能被任何 agent 调用。类比 USB:以前每个工具要为每个 agent 单独适配,有了 MCP 就是插上就能用。
上面所有这些东西的实现加起来,就是 harness。
顯示更多