Register and share your invite link to earn from video plays and referrals.

WquGuru
@wquguru
AI+量化+工程 AI/Invest/Biz/Ship资讯→ 打造Agent PoC→ 📮 hello@wqu.guru
Joined May 2019
559 Following    21.8K Followers
最近 AI 圈总算有点新东西了,@PrismML 把 Qwen3.8 27B 压到了 5.9GB,24GB 统一内存的小 Mac 也能无痛本地跑,更关键的是综合跑分保住了原版的 98.2%;@typesafeai 则把大批量分类/路由做成了 70–500ms 级响应速度,不需要再忍受大模型慢吞吞吐字。
Show more
石破天惊,网络安全研究者有福了,媲美 Qwen3.8 27B的越狱模型,小内存机器也能部署了,无需 DGX Spark,更无需 M5 Ultra。 @PrismML 把 Qwen3.8 27B 压进 5.9GB:三值量化、约 1.72 bit/weight、体积缩小约 9 倍,综合基准仍保留原版 98.2%,262K 上下文,还带视觉。@OrcaRouter 没改任何一个权重,把拒答方向挪到运行时切除,0 改权重、0 重量化、原包 bit-identical,129 个残差干预点,推理时 alpha 可调。 原包 + runtime: 权重:
Show more