註冊並分享邀請連結,可獲得影片播放與邀請獎勵。

SuSu_酥酥👅
@NFT_Chen
#BiBiCrew# Co-founder|@Sydney_Uni Master|Stock & Crypto Trader|AI Builder|Not Financial Advice, DYOR
2K 正在關注    17.6K 粉絲
🫡梁文峰在记忆层动了手脚!为什么bDeepSeek V4.1 Flash 又便宜又强?!不是堆了更多显卡,是把“背课文”从 GPU 里拆走了! V4.1 Flash 的 Engram 把常见词组变成查表,不该算的不再占显存。 SemiAnalysis 拆完记忆层,卡上的数字更刺眼: 🔹输入只激活 80 亿、输出 160 亿,剩下约 1960 亿是查找表 🔹浅层记物体,深层记关系,熟词组直接查,推理留给模型 🔹表只看 token ID,能扔进内存;B300 上从 TP4 降到 TP2,性价比最高抬约 1.6 倍 🔹4 张 GB300 把表卸到主机后,KV 容量还能再涨约 36% 🔹B200 上内存卸载打赢 SSD:同等体验附近,每美元总 token 约 1.21 亿对 5200 万 🔹双机 GB300 上,预填充能到约 5.6 万 token/秒,单用户解码约 253 token/秒 便宜来自少算、少占 HBM; 强来自该查就查、该算就算。 显存带宽比显存容量更值钱。 #DeepSeek# #V41Flash# #Engram# #HBM# #B300# #GB300# #SemiAnalysis# #梁文峰# #梁圣#
顯示更多
🚨惊了!OpenCode 数据页提前曝光下一批模型,目录已经挂上! 这不是官宣能用,是模型 ID 已经进库: 🔹Kimi K4(Moonshot)
 🔹GLM 5.5 Flash(Zhipu)
 🔹DeepSeek V4.1 Pro
 🔹Qwen 3.8 Max Preview Free
 🔹Muse Spark 1.4 Contributor(Meta)
 🔹额外同批出现:
Qwen 3.8 Max Prime(列表标注 9/23,暂无用量)
 现役还是 K3 / GLM-5.3-Flash / V4.1 Flash。K4、5.5、V4.1 Pro 才是下一代信号。 #OpenCode# #AI# #KimiK4# #GLM55# #DeepSeek# #Qwen# #MuseSpark# #OpenSource#
顯示更多
0
23
477
38
轉發到社區
🚨重磅:DeepSeek Harness 官方桌面端已正式现身!Github官方打包好已可下载! 版本 0.1.7-rc.1.20260924.1,对得上官方仓库 tag dsh-v0.1.7-rc.1。欢迎页、本地工作区、账户余额、关于面板都是真界面。 要点如下: 🔹本地文件夹直接当工作区,搜资料、做表格、写代码、排障,不用守着浏览器标签。 🔹官方 Desktop 已在仓库 apps/desktop:Electron 壳 + 内置 Node/pnpm/Python,不先装环境也能开。 🔹上手三步:开始设置 → 选工作区 → 充额度。Token 按实际执行扣,不跑任务不花钱。 🔹安装包还没大规模官宣,社区已从 GitHub 挖到可装版本。认准 deepseek-ai/deepseek-harness,别下不明来源包。 Agent 终于能双击干活了。 #DeepSeek# #DSH# #DeepSeekHarness# #AIAgent# #桌面客户端# #梁文峰# #崔添翼#
顯示更多
0
26
205
25
轉發到社區
😱有钱就是任性!4天半,小米MiMo V2.6 Pro & Flash当着全世界的面烧掉 324万美元!Pro还在继续飞奔,Flash停训超1天! MiMo-V2.6 Pro、Flash RL训练直播最新战报: 🔸合计账单:$3,241,032(Pro $2,386,988 + Flash $854,044) 🔸Pro 仍在 step 29,约 $20,600/小时,单步约 3.0B token;DeepSWE 70.92 🔸Flash 9/19 停在 step 30,约 $10,300/小时,单步 3.7B token;DeepSWE 65.68 🔸配置:1568 prompts × 16 异步 rollout,混训 23套 harness(代码约六成) 🔸卡过:GPU OOM、节点 VRAM、grader 断网、infra 故障瞒了3小时;cyber 数据因坏 rollout 被砍 🔸Flash 停了一天多:有人说还能继续 Scaling,有人说这条 run 已经顶死了 公开面板还在跳: #MiMo# #MiMoV26# #小米AI# #强化学习# #DeepSWE# #AgentRL​​​​​​​​​​​​​​​​​​​​​​​​​​​​​​​​​​​​​​​​​​​​​​​​​​# #雷军#
顯示更多
0
10
92
7
轉發到社區
🔥还有谁?!Jev模型刚出来没几天,NanoJev 已经把整条链路开源了,不是套一层 API,是 0.6B 并行决策模型 + 数据 + 训练管线! NanoJev 把「状态+问题 → 完整概率分布、零 token 解码」这条路直接摊开了: 🔹底座只用 Qwen3-0.6B,一次前向就能并行批处理多个状态、多个问题 🔹动态候选 2–255 个,支持 Choice / Boolean / Score 三类结构化决策 🔹50×50 迷宫:244 步、36 次碰撞到达终点;贪吃蛇 12×12 吃到 27 个食物还活着 🔹模型和数据全开源,训练、评测、持久化推理服务、三栏对照演示一条龙 🔹代码规划 + 模型局部判断,不是纯聊天模型硬解游戏 仓库: 
模型 / 数据:Hugging Face 上的 C-Tianyu/NanoJev 闭源刚喊完 200 倍更快,开源已经把玩具级 System One 端到端跑通了。就问还有谁?! #NanoJev# #Jev# #SystemOne# #开源# #LLM# #Qwen3# #AIAgent# #强化学习# #RLCD#
顯示更多
0
17
553
78
轉發到社區
🚨重磅预警!DeepSeek V4.1 Flash将于今日正式上线! 梁文峰亲自出镜拍推销视频,旁边还配了个超可爱猫耳女仆,标题直接写“DeepSeek V4.1 Flesh”——这波降价+加速+原生多模态,小男梁又要变回梁圣了! 速度起飞、价格再砍,V4 Pro都要被自家V4.1 Flash按在地上摩擦。 ohhh,今天不冲一波更待何时? #DeepSeek# #V41Flash# #梁圣归来# #可爱# #AI# #DeepSeekV4#
顯示更多
0
10
72
8
轉發到社區
💥内测版DeepSeek V4.1 Flash在真实生产级代码工程里拿下国产模型第一,但短板同样清楚! 7组“模型+编程客户端”同题盲测:同一份代码、同一生产级安全问题、完全隔离沙盒,最终结果如下: 1️⃣DeepSeek V4.1 Flash + Claude Code 76.69 2️⃣Qwen 3.8 Flash 75.13 3️⃣Kimi K3-256K 70.73 4️⃣Qwen 3.8 Max 69.58 5️⃣GLM 5.3 64.72 6️⃣DeepSeek V4.1 Flash + DSH 59.92 7️⃣GLM 5.3 Flash 49.16 🔹它赢在哪:安全隐私 88、失败/并发安全与性能拿最高分,缓存命中率全程 99%+,49 分钟跑完,比大参数模型快一截。 🔹它输在哪,也很硬: ▫️宿主环境把分数打穿:换 DSH 直接掉 16.77 分,工具接入、上下文组织、执行流程还不够稳。 ▫️功能正确性 78,输给 Qwen 3.8 Flash 的 82。 ▫️测试质量、架构、兼容性、交付都不是单项第一。 ▫️失败安全绝对分只有 54,事务、并发和失败路径仍有明显提升空间。 ▫️这只是单任务工程评测,不等于通用能力排名。 结论:Flash 已经能打旗舰,但模型本身还没把工程边角打满,客户端更是当前最大变量,Flash道阻且长! #DeepSeek# #V41Flash# #国产大模型# #AI编程# #ClaudeCode# #Qwen# #Kimi# #GLM#
顯示更多
0
29
127
10
轉發到社區
🤔如何解:DeepSeek Harness里的 V4.1 Flash,别被「不支持看图」骗了! DSH 默认把这V4.1 Flash当成纯文本,通道其实已经有了,缺的是模型条目上的视觉声明。 可以这样开: 1️⃣先把模型挂进目录
设置 → 模型 → 编辑 DeepSeek → 自定义设置 → 添加模型
ID 用 deepseek-v4.1-flash-expires-on-0910
名称写成好认的「DeepSeek V4.1 Flash」即可。目录里已有就不用重复加。 2️⃣备份再改配置
点设置页右上角「打开配置文件」,先把 settings.yaml 复制一份。 3️⃣只改这一处
定位到 llm-deepseek 的 models 列表,找到刚加的 V4.1。
在 inputModalities 里,text 下面补上 image,缩进对齐,别动别的字段。
界面里没有「开启视觉」开关,只能改这一行。 4️⃣新对话实测
输入框切到 V4.1 Flash,丢一张截图进去。能描述画面,说明声明生效了。 一句话:模型会看图,DeepSeek Harness默认没登记。补登记,能力才完整。 #DeepSeek# #V41Flash# #DeepSeekHarness# #DSH配置# #多模态# #识图# #AIAgent# #效率工具#
顯示更多
0
20
46
9
轉發到社區
🔥码住:你的Agent配置不对,DeepSeek V4.1 Flash性能直接砍半! V4.1 Flash 内测这几天,很多人第一反应是“怎么还没官方吹的快”。 真相更扎心:模型本身没半残,是 Agent 层参数没对齐。思考档、解析器、缓存前缀、温度,随便错一项,端到端性能直接腰斩。 按常见 Agent 拆开看: 🟠Claude Code / Codex 类 默认把思考开满、工具循环也跟着走。简单改写、查文档、修小 bug 也用 max,首 token 和费用一起翻倍。日常任务先 low / 关思考,硬任务再拉满。 🔵DeepSeek Harness(dsh) 同模型对比里,工程层差距能到接近一倍耗时。reasoningEffort 别全局锁 high/max;长工具链每步都思考,90% 时间会耗在“想”而不是“干”。简单轮次降档,是最高杠杆。 ⚫️Cursor / 编辑器内 Agent 模型名换成 deepseek-v4.1-flash-expires-on-0910 只是第一步。温度别乱改官方 1.0;Agent 场景 top_p 用 0.95,普通对话用 1.0。前缀里塞时间戳、随机 ID,缓存命中率直接归零,输入价差能到几十倍。 🟢Cherry Studio 设置 → 模型服务 → 深度求索 → 添加模型 → 更多设置 → 输入模态选中「视觉」→ 保存。 漏这一项,多模态等于没上。 🟣OpenCode / 自研多 Agent 最容易漏 parser。V4 系要显式开 reasoning-parser + tool-call-parser(deepseek_v4 / hermes 一类),否则工具调用失败、重试、退化成单 token 解码,速度腰斩。 自部署 / vLLM / SGLang 本地 Agent MTP / 推测解码没开、block-size 不对、专家并行没配齐,都会出现“能跑但像残血”。线上 API 也一样:关思考省速度,开 max 换上限,别混用。 一句话:DeepSeek V4.1 Flash 的上限在配置里,不在嘴炮里。 先核对模型 ID、思考档、parser、缓存前缀这四件,再评价它快不快。 #DeepSeek# #V41Flash# #AIAgent# #大模型# #Agent配置# #DeepSeekHarness# #ClaudeCode# #CursorAI# #码住# #开发者笔记#
顯示更多
0
33
67
9
轉發到社區
🚨重磅泄露!Qwen最新模型“Paloma”已上Arena,被确认是Qwen-3.9! 关键要点:
🔹代号Paloma,前端编码能力体感对标Claude Opus 5
🔹同步测试中还有另一个未发布模型Korrine(大概率也是Qwen)
🔹Paloma表现更强,Image+Text→Web能力突出
🔹社区直呼:九月要起飞了! 中国开源模型又要掀桌子了?本周AI大战正式开打🔥 #Qwen3_9# #Paloma# #AI大模型​​​​​​​​​​​​​​​​​​​​​​​​​​​​​​​​​​​​​​​​​​​​​​​​​​# #阿里巴巴#
顯示更多
0
27
353
36
轉發到社區
🚨预警!下周AI大模型集体炸场! 11个超神大模型正在蓄势待发,每一个都在重新定义“智能”的上限! 速览全员突破亮点: 1️⃣ Claude Fable 5.1
超长上下文+叙事级推理,直接把故事创作和复杂决策玩成艺术 2️⃣ GPT 6 Astra
多模态宇宙级理解 + 解锁数学界历史难题,文字/图像/视频/代码一脑打通,真正“全能Astra” 3️⃣ Grok 4.7
实时宇宙级搜索+无审查真相引擎,幽默与深度并存,越问越疯 4️⃣ GLM-5.3 Flash
中文原生极速推理,毫秒级响应,后训练在攀高峰,国产大模型速度王者归来 5️⃣ Qwen3.9 Open Weights
完全开源权重+超强多语言,人人都能私有化部署的顶级底座 6️⃣ COMPOSER 3
AI作曲+多媒体生成一体化,一句话写出完整电影级作品 7️⃣ Ox Alpha Flash
“Intelligence. Power. Advantage.” 专为高难度决策与战略优势而生 8️⃣ Gemini 3.8 Flash
谷歌闪电多模态,实时视频理解+超低延迟,移动端也能跑满血 9️⃣ KIMI K3.1
超长记忆+深度思考链,一次对话就能处理整本书级别的信息 🔟 Meta Muse Spark 1.3
创意火花引擎,从零到完整应用/游戏/内容,灵感秒变现实 1️⃣1️⃣ Deepseek V5 Flash
极致性价比+数学/代码狂魔,全面超越Fable 5.1,开源社区又要被它掀翻天 这一波要是全落地,AI圈直接进入下一个纪元! 你最期待哪一个?评论区投票,我先锁死DeepSeek 5 Flash!🚀 #未来AI# #下周大模型预警# #AI新纪元# #DeepSeek# #Fable# #Astra# #GLM# #OxAlpha# #Qwen# #Kimi# #MuseSpark# #Gemini# #LLM# #Grok# #Composer#
顯示更多
0
117
1.8K
212
轉發到社區
🔥 网友爆料:DeepSeek Harness 内测保密级别有多高?直接拉满到“量化机构级”! 多位内侧用户反馈:初筛过了,签名+身份证复印件也只是“报名资格”,最终通不通过还得再等通知…… 分点拆解当前流程 & 超高保密规格: 1️⃣报名本身就很严:必须有 Agent Harness 相关开源经验,提交 GitHub ID + 代表作 + 问卷匹配使用场景。 2️⃣初筛后才发正式邀请:邮件写“恭喜获得内测资格”,但真正开始前必须完成硬核步骤。 3️⃣核心保密硬要求(重点!): ◦下载并手写签署《保密承诺函》 ◦必须附上身份证复印件 ◦添加官方小助手微信并备注 ◦所有信息仅用于内测资格核验 4️⃣完成以上≠入选:签名+身份证复印件只是拿到“报名资格”,最终放行还要再等官方通知。 5️⃣泄密代价极狠:一旦泄露,不仅取消本次资格,还会直接影响未来所有 DeepSeek 模型、产品内测及合作机会。 保密要求可以理解,但用身份证复印件换一个“可能入选”的资格,DeepSeek 这次对 Harness(Agent 执行框架)的保密级别,已经远超普通产品内测了。 你准备交身份证了吗?还是直接观望?😂 #DeepSeek# #Harness# #内测# #审核# #梁文峰#
顯示更多
0
22
28
5
轉發到社區
🔥 $SPCX Q2财报直接核爆!碾压了他们的预期! 🔹收入 78 亿美元,同比 +92% 🔹每股收益 -$0.09,优于预期的 -$0.24 🔹EBITDA 35 亿美元,同比 +191% 🔹航天收入 9.62 亿美元,同比 +29% 🔹连接收入 43 亿美元,同比 +66% 🔹AI 收入 26 亿美元,同比 +247% 🔹Starlink 订阅用户 1200 万(同比翻倍) 🔹积压订单 475 亿美元 🔹现金及有价证券 1000 亿 从$4.1B到$7.8B,Starlink+AI+Starship三线齐飞! #SpaceX# #SPCX# #财报#
顯示更多