注册并分享邀请链接,可获得视频播放与邀请奖励。

搜索结果 qwen36
qwen36 贴吧
一个关键词就是一个贴吧,路径全站唯一。
创建贴吧
用户
未找到
包含 qwen36 的推特
想买Mac运行大模型? 这是劝退贴 其实估算方法很简单, 现在买 MacStudio 哪怕运行 Qwen3.6-27B 4bit 量化版本, 然后开 DFlash 使用Qwen的内置投机解码, 也就飙到 65token/s. 而现在普遍大模型都能跑到 40 token/s. 如果专门买 MacStudio M3 Ultra 96G 运行大模型, 如果把设备售价 (32999) 换算成使用API, 以 GLM-5.2 为例, 每百万token 28块, 一台 MacStudio 的价格大概能买到 32999/28 = 1178M token. 而为了输出这些token, 买到的 MacStudio 运行 Qwen3.6-27B 要持续运行 209天. 也就是说回本周期至少是200天不间断运行. 然后运行模型才是纯赚. 这还是没算电费和不直接买API而是买套餐的情况.而且, 最重要的是这还是在运行一个只有27B的小模型. 如果真的买512G的 MacStudio (108749, 而且好像已经断货了), 然后运行量化版本的 GLM-5.2, 速度就会跌到只有 17 token/s, 回本周期大概在 7 年左右... 对于现在1.5个月模型就发新版本的情况下, 普通用户自用是绝对不划算的. 所以大部分用户买 coding plan 会更划算, 如果像我一样要测新模型, 直接租卡也会比直接买划算很多. 当然, 如果你本身就有Mac或者显卡, 那么空闲的时候(比如睡觉的时候)让它跑大模型运行任务, 反而是划算的. #本地大模型# #mac# #qwen36# #glm52#
显示更多
0
110
149
11
转发到社区
Qwen3.8-Max 正式发布 当然对于绝大多数人更重要的是,Qwen官宣 Qwen3.8-27B 也将开放权重🥳
qwen3.8 max preview的思考长度真的变态了。 一句话想了快10多分钟了,还没开始正式输出... 还有朋友的任务说思考了30分钟. 输出也超级长,没有耐性还用不了?
显示更多
Qwen3.5-35B-A3B-FP8 在NV DGX Spark GB10上输出测试
0
14
45
2
转发到社区
听说Qwen3.7模型很屌,只能半夜玩 Qoder 夜间 Qwen3.7-Max:0.5x → 0.1x(节省 80%) Qwen3.7-Plus:0.1x → 0.04x(节省 60%)
0
27
36
0
转发到社区
为啥Qwen3.7-max 定价那么贵,DeepSeek 定价那么便宜。 最核心的是Qwen 定价里是包含很大一部分折扣空间的,你可以找阿里云的销售谈折扣,这部分就是灵活的。 据我了解,大客户折扣空间较大,但普通开发者以及ToC小龙虾客户,不是阿里云的目标客群。 而deepseek不需要销售,你爱用不用。
显示更多
0
59
344
11
转发到社区
@cryptoresetlife Qwen3-TTS-12Hz-1.7B-Base-8bit, 本地克隆任何人的声音,只需5秒样本。 出声速度比走网络豆包语音快, 在Mac Studio 512g下实测首音频延迟大约200ms, 效果也是跟sota相比有过之而无不及。
显示更多
都说Qwen3.8大模型属于第一梯队了 那我试试做个游戏看看吧 验证一下,搬好小板凳 等着哈