註冊並分享邀請連結,可獲得影片播放與邀請獎勵。

檢索結果 腾讯混元
腾讯混元 貼吧
一個關鍵字就是一個貼吧,路徑全站唯一。
建立貼吧
用戶
未找到
包含 腾讯混元 的搜尋結果
腾讯混元发布了新的语音识别模型 Hy ASR 3.0 preview。 这个模型可以结合上下文纠错、注入热词,也能处理高噪声和耳语场景。 在开源评测集里,中文普通话 WER 3.34%,英语 2.62%,粤语 3.12%。 目前腾讯云 API 已上线,元宝 App 也已首发免费开放。
顯示更多
腾讯 混元3 这次的开源确实挺给力的 ,不只是开源了推理权重.
腾讯混元 v3 的代码主要在 GitHub 的 Tencent-Hunyuan/Hy3-preview 仓库查看。 主要链接: GitHub 仓库(包含代码、推理脚本、训练文档等): 模型权重下载(Hugging Face 等平台):Hugging Face: tencent/Hy3-preview(以及 Base 版本) ModelScope: Tencent-Hunyuan/Hy3-preview GitCode: 对应仓库也有镜像 其他信息: Hy3-preview 是腾讯混元(Hunyuan)发布的开源 MoE 模型(总参数 295B,激活 21B + MTP 层),支持 vLLM、SGLang 等推理框架。
顯示更多
腾讯混元及 SSV 数字文化实验室联合中科院信工所等机构,正式推出首个覆盖「七体之变」的古文字感知评测基准 Chronicles-OCR。该基准包含 2800 张由专家交叉标注的图像,首次将甲骨文到草书等七种字体的识别难度统一量化。 研究团队评测了 28 个主流多模态大语言模型,结果显示它们在古早字体上几乎全军覆没。在跨时代字符检测任务中,GPT-5 和 Gemini 2.5 Pro 的核心指标接近 0,表现最强的模型也仅有 16.5。即使直接在图上画框免除定位步骤,最高准确率也只有 27.1%,其中 Gemini 3.1 Pro 在甲骨文上的准确率仅 14.0%。 这证实了现代模型严重依赖规整的现代版式先验。面对无约束、强噪声的古代物理介质,模型的文本分割机制直接失效。字体分类结果进一步表明,模型往往是在识别载体纹理(如龟甲或青铜锈),而非真正的字符笔画。 实验还揭示了一个反直觉的现象:开启思考模式反而会导致古文字识别率下降。对照显示,几乎所有支持该模式的模型在开启思考后表现退化。当底层视觉感知缺失时,思维链不仅无法纠错,反而会变成幻觉放大器,输出高自信的错误答案。
顯示更多
腾讯混元 V3.1的文生三维模型芯和图生三维模型能力确实很强,每个账号每天有 30 次的免费三维模型生成调用次数,建议都去体验一下,而且目前还没有充值通道。 地址在这里 #AI# #3D# #hunyuan#
顯示更多
29岁姚顺雨空降:改造腾讯混元的 300 天 - 2024 年,腾讯的高招团队在一场顶级学术会议上认识了姚顺雨。当时这个 97 年的年轻人还是 OpenAI 的研究员,他被介绍给了腾讯总裁刘炽平。一年后,他回国,一跃成为了腾讯的大语言模型负责人。 - 姚顺雨的幸运之处在于,在他来之前,腾讯的最高决策者已经意识到 AI 可能是生死之战,而腾讯远远落后。马化腾在 2025 年的员工大会上说:“一年前我们以为上了船,后来发现那个船漏水了。”他们提前扫清了障碍——混元原先各岗位的关键负责人已悉数离场,姚顺雨可以直接向集团总办汇报,TEG 总裁卢山是一位温和的管理者,愿意最大程度放权。 - 初入腾讯时,姚顺雨向总裁刘炽平提了一个请求:从新模型发布起至少一年,希望总办不要看榜单 (benchmark)。一年大约是训练两代模型的时间。“Martin(刘炽平)同意了。” - 以顾问身份加入腾讯时,姚顺雨任务只有一个:排查混元大模型长期落后的原因。排查结果是:“简单来说,几乎每个环节都在漏水。” 混元过度追求榜单成绩,把打榜语料放进训练集污染了数据,模型变得很会考试,但在真实场景表现很差。当时数据标注准确率的验收线定在 95% ,实际却长期停留在 60%-70%,团队为了交差生产出大批无法使用的数据,算法团队默许了这一切。 - 混元从起步开始就不算顺利。2023 年立项时,项目组连一块 GPU 都没有,最后还是从广告部门匀来 2000 张。卡少导致混元的基础建设(Infra)先天不足,系统缺少针对大规模训练任务的设计。训练环节也不健全,混元几乎没有做过强化学习。竞争压力下,团队做了两个选择,一是换架构,冒险用 Transformer 与 Mamba 结合的混合架构这条路线在行业里尚未被充分验证,“但有噱头。”除了腾讯几乎没有大厂选它。另一条路是打榜,用分数向上汇报。 - 姚顺雨来后几个月内,混元预训练、后训练、评估、Infra 的负责人全部换人,新人来自字节、Kimi、DeepSeek、美团。招人不再看出身——目前混元的模型架构负责人还是一名在读博士生。字节 Seed 的招聘团队发现好几个候选人连 Seed 都没抢过。原因是:Seed 人才密度已经很高,年轻人更容易成为“螺丝钉”;而重建期的混元正是用人之际。 - 改革不是疾风骤雨。姚顺雨没有大量清退老人,但带来的压力更隐晦——他常在群里发论文聊技术,能跟上的人很少,有时甚至看不懂。“Peer 压力太大了。” - 部门层级被简化到只有三层:姚顺雨——方向负责人——研究员/实习生。不赶发版的时候,混元的强度并不大。另一边,混元也取消了部门年中考核,鼓励聚焦长期研发。偶尔也有例外。“只要哪个组来了 Seed 的人,那个组很快就会自发地卷起来。” - 姚顺雨用自己的旧东家 OpenAI 举例给团队鼓劲:直到今天,OpenAI 的基础模型也没有依赖过什么神秘的技术,做大模型没有魔法,也不要相信别人有魔法。真正难的是把最基础、确定能做对的事情都做对——做到这些,足以让混元挤进中国的第一梯队。 - 2026 年 5 月底,距离混元 Hy3 正式发布只剩一个月,因为一批提交上来的数据出了问题。姚顺雨少见地发了脾气,严厉告诫团队:“数据非常重要。如果下次再出现这样的情况,直接走人。” -混元 Hy3 是姚顺雨在年初带队开始训练一款大模型,也是他加入腾讯后的第一张成绩单,但内部抱的预期并不大。Hy3 并不是完全没有企图心。按照姚顺雨的设想,混元不需要在所有能力上正面击败 Claude Opus 这样的前沿模型。如果一个模型能以 Opus 1% 的价格,在 90% 的日常问题上做到与它一样好,甚至超过它,对大多数用户来说这就是一个更优的模型。Hy4 已经在训练中,混元团队的判断是 2027 年进入国内第一梯队。 - 在姚顺雨的构想中,模型与产品应该以联合设计(Co-design)的模式合作,即模型和产品从一开始就绑定在一起开发,模型可以第一时间拿到产品的真实场景和用户反馈,知道自己该往哪里改;产品也能及时向模型同步需求,不用等一个通用模型送上门,再调整、将就。姚顺雨清楚自己当前的主要任务是什么,就是和业务处好关系,把 Co-design 的想法落地 - 今天大模型行业普遍面临商业化难题,但腾讯的思路是,不一定要向外部客户收费,能帮业务提升收入,同样是混元的价值。“举个例子,《王者荣耀》一年收入几百亿,混元如果能帮它提升 1%,那就是好几个亿。” - 在腾讯,一个产品一旦受到高层重视,老板们就会开始密集提意见,其他辅助部门的人也随之加入,参与决策的人越来越多。去年腾讯集全公司资源扶持元宝,于是高层们总会不时提出非常具体的意见,某处的字体是不是太小了,对年长的人不太友好;某处设计为什么要用这种颜色。“上面一提,下面就开始揣摩,老板到底是什么意思,到底要不要改。” - 腾讯 2019 年引入过一批从 Google、Snapchat、Uber 来的工程和数据专家。他们大多没留下什么成果,陆续离开。今天姚顺雨有总办的授权,圈了一块地,一个人拍板负责。但当改革进入更深的地方,牵动更大利益、风险更高时,能替他扛住压力的只有总办。到那时,考验的不只是他,还有他和老板们之间的信任能否撑得住。改革走到最深处,从来就不只取决于改革的那个人。
顯示更多
0
72
424
58
轉發到社區
合作伙伴 | ETH Beijing 黑客松 × 腾讯混元 ETH Beijing 黑客松(6 月 5–7 日)很高兴迎来腾讯混元(Tencent Hy)成为本次活动的合作伙伴。 本次合作中,混元团队将来到现场,和参与的同学与 builder 们交流开源模型与前沿技术,分享实践经验,也一起探讨大家在构建过程中遇到的真实问题。 我们始终相信,开源社区是技术进步的重要推动力。期待在黑客松的这几天里,为开发者们创造更多面对面交流与共创的机会。 黑客松举办在即,点击官网了解日程安排: #ETHBeijing# #Hackathon# #腾讯混元# #开源#
顯示更多
在“无人关注”的角落,腾讯混元发布了一个离线翻译模型,仅440MB。 号称用 1.8B 的参数翻译效果比 Tower-Plus-72B、 Qwen3 35B 的效果都好。 微信自带翻译不会就是这个吧?感觉翻译很快也比较准啊。🤔
顯示更多
0
54
719
72
轉發到社區
前 OpenAI 研究科学家田永龙已确认加入腾讯混元团队,未来将参与视觉语言模型相关研发。 田永龙本科毕业于清华大学,在麻省理工学院(MIT)获得博士学位,曾先后在谷歌研究院(Google Research)、Google DeepMind 担任高级研究科学家,主要研究计算机视觉与生成式模型。 这是腾讯混元继去年十二月招募首席 AI 科学家姚顺雨后,引入的又一位顶尖华人 AI 研究员。
顯示更多
一财放了点姚顺雨的料「腾讯混元3年变形始末」,开始对外传递腾讯在大模型上的组织变化了,这是一个很明确也很有看头的信号,腾讯去年在AI上投了很多钱,但取得的成效我猜内部是不太满意的,所以要在场外做点找补。 而且自从张小龙之后腾讯也不太喜欢以人为主体来建立叙事,满打满算十年来就游戏线的马晓轶和香港帮的汤道生会出镜比较多,这次开始给一个刚入职的新人包装造势,可以说是排面拉满了,也符合AI行业小登为王的趋势。 还是给这篇文章里一些有价值的信息划划重点: - 姚顺雨27岁,是国内大模型团队里最年轻的「一号位」,他在OpenAI只工作了一年,说不上特别核心,但负责的推理模型技术,让他很适合承接从ChatBot到Agent的业务升级,腾讯重金挖他过来,也是急于让他来主导下一个Agent模型的训练; - 腾讯对大模型的反应在国内属于相对落后的那一批,所以人才储备非常薄弱,之前负责大模型业务的两个Leader都没有自然语言处理的背景,团队构成非常「不对口」,去年开始给出薪酬翻倍的条件到处挖人,字节的2-2跳来腾讯就给T12或者T13,相当于直接上涨1-2个职级,再往上T14差不多就是首席科学家了; - 人才流动主要还是在「BAT」三家里内循环,2024年是字节在从阿里撬人,2025年是腾讯开挖自己的墙脚,而年底我们又看到了字节大幅涨薪的通知,内部信里明确表示要保持待遇领先于头部水平,最新的消息是,「腾讯只看来自DeepSeek、月之暗面、字节和阿里这4家基座模型团队的候选人,其他公司是不看的」; - 马化腾对大模型存有误判,他曾打比方说,在工业革命时期,早一个月还是晚一个月把灯泡拿出来,其实没有那么重要。而腾讯错过了很多实验先机,包括浑元大模型如今有些过于路边——在大多数基准测试里,浑元连一个对比项都当不上——所以去年开始着急,很大程度上是在补落下的课; - ChatGPT出来的那一轮周期,正好叠加了腾讯在搞降本增效,对各种「不必要」的花费卡得非常死,AI Lab的员工想去参加学术会议,公司不给钱,继续想办法蹭高校的预算,而AI部门为了完成创收指标,也需要去服务游戏和广告业务,由此结算经济价值,留在基础研究上的人力很少; - 在把姚顺雨放到「一号位」之前,腾讯在大模型上的态度更接近于「调门大、行动少」,既缺少资源,也没有领头人,公司在危机意识层面依然被抖音牵制,以致于总办最关注的业务始终是视频号,而腾讯擅长的赛马机智,在大模型这种「集中力量办大事」的行业不管用了,微信也训练过自己的模型,然后还是放弃了; - 直到去年,腾讯终于开始效仿字节Seed,重新组建符合大模型研发标准的组织架构,设立更符合前沿科学原理的岗位,再去为一个个的坑找萝卜,并逐步淘汰掉旧技术线的人力,当姚顺雨空降落地之后,管理上的障碍基本上也都已经打扫干净了; - 今年会是姚顺雨的大考,他需要为腾讯训练出一个足以回到牌桌上的领先模型,只有高分答卷,才能让他坐稳在腾讯这家大厂AI一把手位置,好在前人的肩膀够多,相比GPT-4和o1时代大家都不知道怎么实现的盲目,现在的大模型行业已经少了很多「秘方」,头部模型的能力更是高度对齐,留给腾讯的时间,不多但也不少。
顯示更多
0
48
213
15
轉發到社區