注册并分享邀请链接,可获得视频播放与邀请奖励。

WquGuru
@wquguru
AI+量化+工程 AI/Invest/Biz/Ship资讯→ 打造Agent PoC→ 📮 hello@wqu.guru
加入 May 2019
559 正在关注    21.8K 粉丝
石破天惊,网络安全研究者有福了,媲美 Qwen3.8 27B的越狱模型,小内存机器也能部署了,无需 DGX Spark,更无需 M5 Ultra。 @PrismML 把 Qwen3.8 27B 压进 5.9GB:三值量化、约 1.72 bit/weight、体积缩小约 9 倍,综合基准仍保留原版 98.2%,262K 上下文,还带视觉。@OrcaRouter 没改任何一个权重,把拒答方向挪到运行时切除,0 改权重、0 重量化、原包 bit-identical,129 个残差干预点,推理时 alpha 可调。 原包 + runtime: 权重:
显示更多
0
44
1.1K
155
转发到社区