我最近越来越烦一件事,在 orchestrator 里写死用 Claude 的哪一版、用 OpenAI 的哪一版。
这种写法看起来天经地义,其实埋了个维护地雷。
模型名是这套系统里最不稳定的接口:会改名、会停更、会重定价,能力排名几个星期就洗一次牌。
把这些写进编排逻辑,等于把最不稳定的东西做成了硬编码。
每发布一个新模型,你就得在 prompt、路由代码、eval 配置里做一轮全局替换。
我想要的其实是一个 tier 抽象:告诉编排器这类任务用中档推理模型,而不是用某个具体版本。
tier 才是稳定的契约,模型名只是它背后的一个可变实现。
这个抽象有成本:tier 到具体模型的映射本身也要维护,而且同样会过期。
但它把 churn 隔离到一个地方,而不是让它渗透进每一行编排逻辑。
判断一个 agent 系统的工程成熟度,看它把模型名藏得多深就知道了
显示更多