注册并分享邀请链接,可获得视频播放与邀请奖励。

搜索结果 4090
4090 贴吧
一个关键词就是一个贴吧,路径全站唯一。
创建贴吧
用户
未找到
包含 4090 的推特
太优雅了,妈的 NV 从 4090 开窍,原厂的老钱风你 ROG 学一万年都学不会,总是一副暴发户的样子…哦 proart 好点,但 80 到头…
我在 16g 丐版 4090 上装了 qwen 35b 4b 量化的越狱版,已经稳定进行了一周多。拿来测试和日常交互完全足够了,指令跟随也可用,甚至还能假装写一些代码。 其实我觉得很多所谓企业智能体,这个能量级尝尝鲜就够了。 真别瞎折腾。
显示更多
0
39
107
3
转发到社区
你以为在本地跑 35B 大模型得配 4090?其实一张 6GB 的老卡就够,就靠这三点: 1、模型选 MoE 架构,35B 总参数,每次只激活 3B; 2、用 IQ2 量化,把体积压到 11GB 出头; 3、不常用的部分甩给内存和 CPU 跑,别全压显卡。 社区实测 6GB 显存跑出 30 字每秒,比 ChatGPT 免费版还快,还断网能用、隐私不外发、问什么都不拒答。
显示更多
男人一生只哭七次 没买原价的3080 没买原价的4090 没买史低的5090 25年十月之前没买内存 25年底之前没买固态 26年一季度显卡没下车 26年二季度没上显卡末班车
显示更多
我没想到 6000 pro 还有 MIG 能力…这就好玩了,4 个 4090 是吧
刚看了个视频,最近新出的 Qwen3.6 27B 大家都跑了吗?用单卡 4090 原生跑,速度才 20 Token/秒,写个代码慢得让人想砸键盘。 但他疯狂折腾了各种优化,直接把速度干翻了近10倍!这有点牛逼了,给大家说下他的优化方法。 干货全在这: 1️⃣ 4bit量化:速度直接翻倍,画质(精度)几乎不掉。 2️⃣ MTP投机解码:让显卡火力全开,一路飙到 108 Token/秒! 3️⃣ 最新黑科技 DFlash:借用AI生图的思路搞文本,峰值直接干到 184 Token/秒,快到起飞! 最牛的是现在有个叫 TurboQuant 的技术,能把缓存无损压缩 4 倍。就算你只有 24G 显存,也能跑满 200K 的超长上下文!但是哈,这是优化KV Cache的,场景优化现在不是很好... 等生态起来吧 别整天喊算力焦虑了,只要优化弄得好,你的电脑就是个小型数据中心! 不知道大家跑的时候有没有去优化,后面都试试。 你的跑出来是多少? #AI# #AIAgent#
显示更多
之前闲鱼上很多回收商,为了让卖家放心出,都可以直接安排顺丰上门,拿走即确认。(甚至我 4090 也是这样的流程,当然提前视频验过了) 昨天出了小米净化器 Ultra,谈好后回收商下单顺丰取件,然后直接就把咸鱼订单确认收货了,说免得待会有事忘了。 讲信用的世界真美好。
显示更多
智谱 AI 开源的大模型视频生成架构(CogVideo / CogVideoX 系列),GitHub 斩获 12.8k Star。直接把长视频生成、图生视频的部署门槛砸到了消费级显卡水平。 10秒长视频生成:打破 AI 视频“前 3 秒惊艳,第 4 秒变形”的死穴,能稳住连续动态。 低显存优化:经过量化与 CPU Offload 处理,普通 4090 或 INT8 方案几 G 显存就能在本地拉跑。 图生视频 & 高清分级:支持 1360*768 等多分辨率自由定画幅,还提供了 ComfyUI 工作流封装。 生态极度丝滑:已有现成的 Gradio WebUI,顺带支持自定义 LoRA 微调(比如做室内设计、微缩场景)。 🔗 链接 & 源码 GitHub:
显示更多
吴说获悉,据 Arkham 援引 beaconcha in 数据,以太坊验证者退出队列已降至 0,解除质押无需等待;与此同时,约 248 万枚 ETH 正在排队进入质押,预计等待约 43 天。此前,退出队列曾于 2025 年 9 月超过 260 万枚 ETH。目前约 4090 万枚 ETH 处于质押状态,占总供应量约 33.55%,活跃验证者约 88.5 万个,平均年化收益率约 2.64%。
显示更多
黄金本轮涨跌核心受美伊冲突局势影响,伊朗扬言反击美军基地、地缘冲突升温并未持续提振黄金,行情走完下跌后进入短期反弹阶段,整体大趋势依旧偏空,本次反弹仅为下跌途中修复,并非反转。 黄金高低点持续下移,下跌大趋势清晰,当前仅属于下跌后的小幅反弹,不改变空头主基调,不适合盲目抄底做多。4133-4138 为强压力颈线位,行情多次冲高至该区间承压回落,只要价格无法站稳突破此位置,空头趋势不变 实操思路 反弹至 4140-4150 压力区间布局空单,止损4170 行情预期:本轮反弹结束后,如果跌破4090,金价有望下探 4020 一线低位
显示更多