TwiScan
热门
社区
账号集合
登录
注册
English
日本語
한국의
简体中文
繁体中文
注册并分享邀请链接,可获得视频播放与邀请奖励。
立即注册
Lonely
@Lonely__MH
👨💻 独立开发者 | AI Builder | 互联网打杂 专注 Agent 与 AI 工具实测,写小白也能懂的硬核教程 生命不息,Bug不止 📮合作/交流:bd
@aigce
.com
加入 December 2014
781
正在关注
26.6K
粉丝
Lonely
@Lonely__MH
2026.09.23 05:28
🎉见证历史!国产开源大模型直接登顶 Hugging Face 双榜第一! 刚刷到网易有道开源的实时流式语音大模型:Confucius4-R2T2 ,基于 Qwen3-ASR-1.7B 微调 另外顺带把流式翻译模型 T3PO 一起开源了 刚发布就同时斩获 HF ASR 与 Translation 两大细分垂类的 Trending 榜一,太燃了🔥 为了测测到底有多硬核,我把 R2T2(1.7B / GGUF 约 2.2GB)直接部署在自己的 MacBook Pro M2 上,跟行业老大哥 OpenAI Whisper-Large 做了对比 视频画面反差极其强烈(重点看 0:21 秒高能👇) 🔥几个比较有意思的点: 1. 前缀稳定(独创 Stable Prefix 只增不改) 增量重识别下,已输出文本基本只追加、不回改。 50 秒英文音频、2.5 秒步进:已出文本被改写 Whisper 16 次,R2T2 1 次;等效退格 1137 vs 39 字符。 2. 截断处不补全 音频切在半句时,只输出有声学证据的部分,不靠语言模型先验去猜后文。 中文改口指令:Whisper 出现繁体和错字,R2T2 零改写。对下游 LLM / Agent 来说,前缀可以直接消费 3. 端侧可部署 1.7B,Q8_0 GGUF 约 2.2GB,llama.cpp + Metal 在 16GB M2 Pro 上本地推理。 官方 vLLM 方案需要 N 卡,Mac 走 GGUF 即可。 模型👉🏻 代码👉🏻 适合本地部署,做语音输入法、实时字幕、会议助手 有需要的,可以试试。 以上。
显示更多
0
0
54
581
93
转发到社区
热门用户
狱
@Wx1n11124
254.7K 粉丝
オリコンニュース
@oricon
1.9M 粉丝
New York Post
@nypost
4.2M 粉丝
吴说区块链
@wublockchain12
181.4K 粉丝
空空道人
@Kongkongda5882
34K 粉丝
李李Momo💋
@Lili33O49
23.7K 粉丝
玉米棒棒
@fljjx61
478.6K 粉丝
TVer新着
@TVer_info
100.8K 粉丝
ツイッター速報〜BreakingNews
@tweetsoku1
256.6K 粉丝
中國新聞社
@CNS1952
547.4K 粉丝
政经鲁社长
@xzzzjpl
733.3K 粉丝
看中國
@kanzhongguo
348.8K 粉丝
华尔街观察 Xtrader
@cnfinancewatch
129.5K 粉丝
香风智乃
@ManuMougan
20.7K 粉丝
李李moMo
@LiLi_33094_
8.5K 粉丝