"Hy4 preview 是 Hy4 迭代的一个早期版本,预训练和后训练均仍有较大的提升空间,也有一些已知问题,如复杂任务的长思考和过度自我验证倾向,我们将持续敏捷迭代"
显示更多
📢 Hy4 Preview 现已登陆 API!
作为腾讯混元团队最新推出的 770B 稀疏 MoE 开源大模型,Hy4 Preview 每 Token 激活 49B 参数,在腾讯内部 203 项实际工程任务盲测中表现优异。
现已开放官方 API 渠道全量接入,欢迎体验!
👉 体验入口:
🔗 了解更多:
显示更多
腾讯混元发布Hy4 preview,总参数770B,激活参数49B,上下文长度1M。据介绍,Hy4 preview在模型尺寸、上下文长度、数据规模上都进行了显著的扩展,预训练和后训练的共同进步带来了智能水平的又一次巨大提升,稳居开源模型第一梯队。
显示更多
简单看了一圈刚发布的 Hy4 preview,我觉得有 3 个点挺有意思。
第一,它明显在为长任务和 Agent 做准备。
1M 上下文背后塞了 Sparse Attention、IndexCache、MTP,不只是把窗口数字拉大,而是在解决长链路任务真正跑不动的问题。
第二,Hy4 已经开始参与“研发自己”。
从训练策略、评测到推理优化都开始让模型参与,官方给出的吞吐提升是 31.8%。
第三,模型竞争开始从“会不会答题”,转向“能不能长期干活”。
腾讯也开始拿真实工程任务测试,缓存价格已经打到了 0.3 元 / M Token。
看来这次腾讯是像这种动真格的了,已经不再是比单纯的模型能力,而是谁更适合成为长期运行的 Agent 底座。
显示更多
分享LLM Stats看到的大模型排名世界前十五名里有意思的事情
1. 腾讯Hy4 Preview 位列第十(高于Claude Opus4.8)
2. 前十五名,九个闭源全是美国大模型,六个开源全是中国大模型
3. 智谱最近发的两个大模型都上榜了,且GLM5.3-Flash是前十五模型中最便宜的👏
4. Kimi在中国大模型中排名最高,但是有点叫好不叫座,酒香也怕巷子深,需要搞点营销和故事
显示更多
【第三期】本周免费白嫖一线大模型的方法整理了:
Agent:
1. OpenCode 无需绑卡免费使用Muse Spark 1.3、 Muse Spark 1.2 (需要切代理或者开tun),1.3是目前顶级大模型
3. Cline 无需绑卡免费使用GLM-5.3-Flash、 DeepSeek-V4-Flash、Muse Spark 1.3, 只需要安装cline和注册一个账号,命令行使用的适合写代码
4. WorkBuddy国际版 9.11-9.25 限时免费DeepSeek-V4.1-Flash、Hy4 Preview
5. WorkBuddy国内版 8.28-9.30 限时免费Hy4 Preview,注意补充之排队比较久
中转站(使用慎重,估计基本会拿你的数据):
1. 孙割的中转站,免费使用Qwen-3.8-Flash,这个要接入到自己的Agent使用,可以把文档丢给Agent让他帮你配置,咱也能割到孙割了
2. orcarouter 发布越狱模型中转站,需要绑卡才免费提供GLM 5.3 Flash、DeepSeep V4 Flash,要接入自己的Agent使用
3. experientiallabs 同样需要绑卡,提供免费的DeepSeep V4 Flash
感谢开源的贡献,基本能让大家免费用上一线大模型了,泪目
显示更多
【第二期】本周免费白嫖一线大模型的方法更新了:
1. 登录后,右上角选择Direct模式,可以免费用Claude Fable 5.1
2. OpenCode Muse Spark 1.3 Muse Spark 1.2 (需要切代理或者开tun),1.3是目前顶级大模型
3. Hermes Agent 共享OpenCode的免费大模型
4. Cline 免费使用GLM-5.3-Flash DeepSeek-V4-Flash, 只需要安装cline和注册一个账号(不需要绑定支付方式),命令行使用的适合写代码
5. WorkBuddy Hy4 Preview新发布限时到下周,排队比较久,不充钱可以不考虑了
6. 孙割的中转站,免费使用GLM-5.3-Flash、Qwen-3.8-Flash,这个要接入到自己的Agent使用,可以把文档丢给Agent让他帮你配置,咱也能割到孙割了
7. 智谱夜间(23点到次日9点)在Zcode中免费蹬GLM-5.3-Flash, 需要订阅Coding Plan
显示更多
8月份中国大模型发布和开源情况timeline:
- Qwen3.8-Max (8月3日) API 发布、权重暂未开放
- Qwen3.8-2.4T-A95B (8月12日)开源,实际是Qwen3.8-Max的开放权重版本
- DeepSeek-V4-Pro-0813 (8月12日)开源,8月12日晚上发的
- Qwen3.8-27B (8月14日)开源
- GLM-5.3 (8月14日)开源,真正开放权重是 8月28日
- DeepSeek-V4-Flash-Vision-Exp (8月21日)DeepSeek-V4-Flash的多模态版本,只开源了DeepSeek-V4-Flash-0731
- Qwen3.8-Flash-Next (8月26日)开源
- GLM-5.3-Flash (8月26日)开源
- Hy4-Preview (8月28日)开源
压力给到字节?🤔
显示更多
最近我免费白嫖一线大模型的方法整理了一下:
1. Cline 免费使用GLM-5.3-Flash DeepSeek-V4-Flash, 只需要安装cline和注册一个账号(不需要绑定支付方式),命令行使用的适合写代码
2. OpenCode Muse Spark 1.2 (国区不可用,需要切代理),也是适合命令行写代码
3. WorkBuddy Hy4 Preview新发布限时免费两周,这个啥活都能干
4. 孙割的中转站,免费使用DeepSeep-V4-Flash-Vision-Exp(非多模态也免费)、GLM-5.3-Flash、Qwen-3.8-Flash,这个要接入到自己的Agent使用,可以把文档丢给Agent让他帮你配置,咱也能割到孙割了
感谢开源的贡献,基本能让大家免费用上一线大模型了,泪目
显示更多
朱啸虎对腾讯 AI 的真实评价。
朱啸虎昨天的新访谈,有几个观点我还是比较认可。总结下:
第一,模型 API 这门生意,很难长期维持高毛利。
Anthropic 现在能做到 60% 左右的毛利,核心还是模型智能能力比较强,尤其 Coding 这类场景,过去一段时间确实有明显优势。
但这个优势已经开始越过临界点了。当其他模型逐渐追上,价格可能只有你的十分之一,怎么可能一直维持这么高的溢价?
哪怕 Anthropic 的模型未来几年还能保持领先,但如果智能能力只强 10%,价格却高 50%,用户真的会一直买单吗?
智能最终会越来越像电和水。模型 API 这一层,长期可能就是 10% 到 20% 的毛利。这是比较合理的。
一旦能力逐渐趋同,价格战很难避免,大家也会越来越有动力切换到更便宜的模型。Anthropic 现在着急上市,也可能和这个窗口期有关。
第二,AI 办公的市场肯定比 AI Coding 大很多。
AI Coding 最先跑出来,很重要的一个原因是工程师本身就对 AI 的接受程度就比较高。而且 Coding 是一个特别适合 AI 的场景,任务相对明确,结果也比较容易验证。
但 AI Coding 只是办公的一部分。真正更大的市场,还是整个的白领市场,也就是现在大家都在拼的 AI 办公。
再进一步,AI 办公本质就是通用 Agent。之前的 Coding 只是一个垂直场景,办公是整个白领市场。就像当年微软的 Office 一样,你会发现只要有电脑的地方,就会有 Office。
第三,AI 办公产品的竞争力是 Model + Harness + Product + Context。
今年前半年,行业聊 Harness 比较多。但 100%可以预测到,随着 Harness 这一层趋同,最终的竞争肯定会转移到 Context。
因为 AI 办公的杀手级应用场景是工作,诸如分析数据,写 PPT 和分析报告等等,这类任务的交付结果,直接取决于 AI 到底掌握了多少企业的工作上下文。
就像一个新员工一样,你想让它把工作干好,又不让它了解背景,那即便他再聪明也无济于事。
Context 肯定会成为这一轮 AI 办公竞争中非常重要的壁垒。
基于这三个判断,朱啸虎也聊到了腾讯的 AI 发展。相对还是比较客观。
当然,我也不否认朱啸虎有他的局限性,大家主要看看他的思考逻辑,是不是对我们理解一家公司和趋势有启发。
腾讯在这一轮 AI 浪潮里,目前看还是非常典型的后发制人。
最开始混元模型,说实话,在业界都没什么存在感。但现在做到 Hy4 preview,已经逐步的挤进国内第一梯队了。
到了这一轮 AI 办公,WorkBuddy 反而跑出来了,而且已经成为国内第一梯队的办公 Agent 应用。
朱啸虎说金沙江也购买了 WorkBuddy 的企业账号。
为什么?
一方面当然是 WorkBuddy 本身的产品体验不错。另一个很重要的原因是金沙江本来就在用企业微信。
企业微信里已经沉淀了公司的组织关系、历史沟通,再加上腾讯会议、腾讯文档,本身就在同一个体系里。对于 WorkBuddy 来说,这些都是现成的 Context。
如果换成一个独立的 AI 办公产品,就要重新连接知识库、文档、会议,甚至重新处理组织关系和权限。
朱啸虎还有一个判断我也很认可。现在模型能力当然还重要,因为大家还处在交替领先的阶段。但只要模型之间的差距继续缩小,技术优势就很难成为长期壁垒。
到了那个时候,竞争又会回到传统互联网的几个指标上。比如谁掌握了入口、谁有获客优势、谁能拿到用户的历史数据。这些恰恰是腾讯这样的公司最有优势的地方。
如果把去年的 ChatBot、AI Coding,再到今年的 AI 办公放在一起对比,会发现 AI 应用的竞争焦点确实一直在往上层迁移。
最开始的 ChatBot 拼的是模型能力,那时候谁的模型能力强,谁的产品体验就更好。但到了后来的 AI Coding,大家发现,光模型强还不够,Harness 也很重要。因为在长程任务里,模型怎么调用工具,怎么处理错误,会直接影响最终的结果。
现在到了 AI 办公,又开始发现,Model 和 Harness 上面,还有 Context。
所以我一直觉得,AI 办公这种通用级 Agent,最后大概率还是大厂或者超级明星创业公司的生意。因为做到这一步,已经很难靠一个单点能力赢了,后面牵扯的东西会越来越多。
显示更多