简单看了一圈刚发布的 Hy4 preview,我觉得有 3 个点挺有意思。
第一,它明显在为长任务和 Agent 做准备。
1M 上下文背后塞了 Sparse Attention、IndexCache、MTP,不只是把窗口数字拉大,而是在解决长链路任务真正跑不动的问题。
第二,Hy4 已经开始参与“研发自己”。
从训练策略、评测到推理优化都开始让模型参与,官方给出的吞吐提升是 31.8%。
第三,模型竞争开始从“会不会答题”,转向“能不能长期干活”。
腾讯也开始拿真实工程任务测试,缓存价格已经打到了 0.3 元 / M Token。
看来这次腾讯是像这种动真格的了,已经不再是比单纯的模型能力,而是谁更适合成为长期运行的 Agent 底座。
显示更多