TwiScan
인기
커뮤니티
계정 컬렉션
로그인
회원가입
English
日本語
한국의
简体中文
繁体中文
가입 후 초대 링크를 공유하면 동영상 재생 및 초대 보상을 받을 수 있습니다.
지금 가입
雨哥向前冲
@xiangxiang103
AI Spark联合创始人 |AI培训+企业咨询 独立开发|专注 AI 工具实测|新手教程|最新动态 wx:hanyu1212|网站:
가입 April 2021
1.4K
팔로잉 중
14.7K
팬
雨哥向前冲
@xiangxiang103
2026.08.26 17:51
Qwen3.8-Flash-Next 本地部署有点离谱了。 125B MoE,Unsloth 直接压到了 75GB 内存就能跑。 不是 75GB 显存。 是 RAM / Mac 统一内存。 这意味着什么? 一台大内存 Mac,甚至一台没有独显、只有大内存的机器,理论上都能把这个 125B 模型装进去跑。 而且这次 Qwen3.8-Flash-Next 每个 token 只激活约 6B 参数,Unsloth 甚至声称 CPU RAM / 统一内存可以做到接近 VRAM 的推理速度。( 但我现在最想看的反而不是 Benchmark。 而是一个最土的问题: 到底多少 token/s? 75GB 的 1-bit 确实把“能不能跑”的门槛打下来了,但如果实际只有几 token/s,那叫成功启动;如果大内存 Mac 真能稳定跑到可交互的速度,那事情就完全不一样了。 因为以后本地大模型拼的可能不再只是: 你有几张 5090。 而是: 你有多少内存,以及多大的内存带宽。 你们赶紧借我一台大内存 Mac 实测一下🤣 如果 125B 真能在这种机器上跑到可用速度,二手 Mac 的玩法可能真要变了。
더 보기
Unsloth AI
@UnslothAI
2026.08.26 15:45
Qwen3.8-Flash can now be run locally! 🔥 The 125B MoE model outperforms Claude-Opus-4.6 (Max). Run on 75GB RAM via Unsloth GGUFs. Qwen3.8-Flash-Next enables CPU RAM / unified mem setups to deliver near VRAM speeds. Guide: GGUF:
더 보기
0
0
2
9
0
커뮤니티로 전달
인기 있는 사용자
New York Post
@nypost
4.2M 팬
オリコンニュース
@oricon
1.9M 팬
吴说区块链
@wublockchain12
181.5K 팬
TVer新着
@TVer_info
100.9K 팬
Reuters
@Reuters
26.4M 팬
ツイッター速報〜BreakingNews
@tweetsoku1
256.8K 팬
First Squawk
@FirstSquawk
569.4K 팬
Bloomberg
@business
10.5M 팬
billboard
@billboard
16.8M 팬
PR TIMESテクノロジー
@PRTIMES_TECH
28.3K 팬
中國新聞社
@CNS1952
547.7K 팬
一劍浣春秋
@chee828
0 팬
空空道人
@Kongkongda5882
34.2K 팬
zerohedge
@zerohedge
3.4M 팬
モデルプレス
@modelpress
2.1M 팬