TwiScan
Hot
Communities
Account collections
Login
Register
English
日本語
한국의
简体中文
繁体中文
Register and share your invite link to earn from video plays and referrals.
Register now
雨哥向前冲
@xiangxiang103
AI Spark联合创始人 |AI培训+企业咨询 独立开发|专注 AI 工具实测|新手教程|最新动态 wx:hanyu1212|网站:
Joined April 2021
1.4K
Following
14.7K
Followers
雨哥向前冲
@xiangxiang103
2026.08.26 17:51
Qwen3.8-Flash-Next 本地部署有点离谱了。 125B MoE,Unsloth 直接压到了 75GB 内存就能跑。 不是 75GB 显存。 是 RAM / Mac 统一内存。 这意味着什么? 一台大内存 Mac,甚至一台没有独显、只有大内存的机器,理论上都能把这个 125B 模型装进去跑。 而且这次 Qwen3.8-Flash-Next 每个 token 只激活约 6B 参数,Unsloth 甚至声称 CPU RAM / 统一内存可以做到接近 VRAM 的推理速度。( 但我现在最想看的反而不是 Benchmark。 而是一个最土的问题: 到底多少 token/s? 75GB 的 1-bit 确实把“能不能跑”的门槛打下来了,但如果实际只有几 token/s,那叫成功启动;如果大内存 Mac 真能稳定跑到可交互的速度,那事情就完全不一样了。 因为以后本地大模型拼的可能不再只是: 你有几张 5090。 而是: 你有多少内存,以及多大的内存带宽。 你们赶紧借我一台大内存 Mac 实测一下🤣 如果 125B 真能在这种机器上跑到可用速度,二手 Mac 的玩法可能真要变了。
Show more
Unsloth AI
@UnslothAI
2026.08.26 15:45
Qwen3.8-Flash can now be run locally! 🔥 The 125B MoE model outperforms Claude-Opus-4.6 (Max). Run on 75GB RAM via Unsloth GGUFs. Qwen3.8-Flash-Next enables CPU RAM / unified mem setups to deliver near VRAM speeds. Guide: GGUF:
Show more
0
0
2
9
0
Forward to community
Most Popular Users
Tibo
@thsottiaux
776.4K Followers
Serenity
@aleabitoreddit
1M Followers
Donald J. Trump
@realDonaldTrump
111.9M Followers
Elon Musk
@elonmusk
241.7M Followers
Sam Altman
@sama
6.3M Followers
New York Post
@nypost
4.2M Followers
OpenAI
@OpenAI
5.4M Followers
zerohedge
@zerohedge
3.4M Followers
Wall St Engine
@wallstengine
198.7K Followers
SpaceXAI
@SpaceXAI
2.1M Followers
First Squawk
@FirstSquawk
569.4K Followers
Polymarket
@Polymarket
2M Followers
Anthropic
@AnthropicAI
1.8M Followers
Ansem 🐂🀄️
@blknoiz06
1.4M Followers
Kalshi
@Kalshi
472.6K Followers