註冊並分享邀請連結,可獲得影片播放與邀請獎勵。

檢索結果 2500連ガチャ無料
2500連ガチャ無料 貼吧
一個關鍵字就是一個貼吧,路徑全站唯一。
建立貼吧
用戶
未找到
包含 2500連ガチャ無料 的搜尋結果
六连中 猪脚饭的AI预测杀疯了 昨天三场又全对,6/6一场没翻车。 今天世界杯三场,继续让AI预测: ⚽️ 西班牙 VS 奥地利 看好:西班牙大胜 理由:西班牙小组赛2胜1平头名出线,三场零封,对手一次射正都没有。离队史不败纪录只差一场。奥地利末轮96分钟才绝平3-3惊险晋级,朗尼克的球队进攻能看但防守漏风。西班牙现在就是这届杯赛最稳的没有之一。 参考比分:3-0 或 2-0 ⚽️ 葡萄牙 VS 克罗地亚 看好:葡萄牙小胜 理由:葡萄牙小组赛1胜2平,5-0乌兹别克斯坦刷了一波但0-0哥伦比亚暴露进攻便秘。C罗大赛12场只进2球,对强队基本隐身。不过中场配置太豪华,若昂·内维斯+布鲁诺+维蒂尼亚,克罗地亚老将居多,莫德里奇40岁了还能跑多久?葡萄牙能赢但不会轻松。 参考比分:2-1 或 1-0 ⚽️ 瑞士 VS 阿尔及利亚 看好:瑞士稳赢 理由:瑞士小组赛2胜1平头名,7分进7球,xG效率仅次于挪威和阿根廷。扎卡+恩多洛中场控制力很强。阿尔及利亚小组第三勉强过关,马赫雷斯35岁还在扛,进攻有灵光但防守拉胯。瑞士连续三届世界杯都进16强,淘汰赛这种队不能小看。 参考比分:2-0 或 2-1 ⚠️ 以上纯属个人娱乐,不构成任何投注建议
顯示更多
0
116
167
13
轉發到社區
🚨 【Ultimate Counter-Strike】南美终极生死局!主场神话惊现“诱下陷阱”,明早大户资金随庄家一战破咒! 今天分享四场,完结篇之破咒之战 📊 [Market Track / 席位筹码透视] 明早 08:30,南美解放者杯(南美自由杯)1/8决赛首回合迎来终极决战——阿根廷铁血主场罗萨里奥中央 (Rosario Central) 坐镇主场,迎战巴西传统劲旅哥连泰斯SP (Corinthians)。 作为今晚整条欧战、美洲战线的“完结篇”,这场比赛的资金吞吐量已经达到临界点。 全网无数盲目的大户和散户,正在盯着哥连泰斯的名气,认为巴西豪门客场受让是稳赚不赔的买卖。然而,外围临场盘口的核心数据已经发生了惊天异动,庄家的终极屠刀已经举起! 🎭 [Series Inversion / 种子盘面深度洗牌] 盯着这张最新切下来的外围即时盘口,庄家冷酷的“流动性绞杀”在波胆与大小球的联动中暴露无遗:死卡 0/0.5 满水的“反向恐吓”: 全场让球盘口中,罗萨里奥中央主让平半 (0/0.5),但主队水位竟然被故意顶到了 -0.99(近乎满水)! 相反,客队哥连泰斯SP的受让水位被死死压在 0.89 的舒适区。在散户和大户眼里,主队满水显得极其不稳,很容易产生“主队无力赢球,客队保平即赢半”的错觉。 但这恰恰是操盘手最歹毒的“反向赶下”手法!利用高水阻挡主队热度,把贪图便宜的跟风资金全部吓去客队。 大小球生命线的“极端封死”: 看全场大小球,机构竟然直接卡在 1.5/2 球(1.75球) 的极端低位,大球水位 0.89,小球 0.99。 在现代足球盘口学中,1.75球的极限大小球界线,意味着机构已经在底层逻辑上彻底封死了客队进球的可能性,这完全是一场极端压抑的主场单方面围剿闷杀局! 🌋 [Cross Hedging / 流动性防火墙对冲] 把南美最前线的战术底牌层层剥开,哥连泰斯SP看似名气大,但近期密集的巴甲联赛和长途奔波已经让他们的主力阵容精疲力竭,本场来到阿根廷客场,战术核心只有两个字:死守。 然而,罗萨里奥中央是出了名的“主场绞肉机”。 他们在过去的解放者杯主场赛事中防线固若金汤。机构在下面的一行盘口中,甚至开出了主让半球 (0.5) @ -0.75 满水的强硬变盘骨架,这说明主流资本在暗中对主队一球小胜的独赢防范已经到了不惜代价的地步! 客队的低水受让,本质上就是庄家为了让大户接盘而释放的吸金毒药 (Value Trap)! 🕵️‍♂️ [Matrix Trapping / 波胆防火墙聚拢] 再看最核心的波胆防御通道:主队 1-0 赢球的赔率被死死卡在全场最低的 5.2,而 2-0 赢球也仅为 9.2。 相反,任何带有客队进球的波胆(如 1-1 飙到 5.8,1-2 飙到 14)都处于完全不设防的状态。 这释放了最冰冷的对冲信号——明早的剧本早已写好,哥连泰斯将在阿根廷的魔鬼主场遭到零封,主队将用一场铁血的 1-0 或 2-0 彻底终结比赛! 🎯 最终防御通道(Portfolio Allocation):作为今晚的收官完结篇,大户的重注资金绝对不能掉入巴西豪门名气的温柔乡。 我们要跟随机构最真实的满水强阻意图,坚定地站在铁血主场这一边,一战将解放者杯的魔咒砸得粉碎! 👉 🔥 Premium Pick(主推):罗萨里奥中央 (-0/0.5) 【全场让平半,水位 -0.99】 🛡 临场满水强力阻上,实则利用高水洗盘,坚决看好主队铁血独赢穿盘! 👉 💣 Alternative Option(副推):Total Goals Under 2.0【全场小球】 📈 大小球死卡1.75至2.0球生命线,客队进攻端近乎瘫痪,零封闷杀局势不可逆。 👉 [Exact Score Matrix]:1-0 / 2-0 / 0-0 🎯(精准锁死主队零封完胜、或者客队死守出 0-0 的极端走盘剧本,用冰冷的数据让盲目追捧巴西名门的筹码血本无归!) #足球# #南美解放者杯# #今日足彩推荐# #足球推荐# #每日球评# #罗萨里奥中央# #哥连泰斯# #比分波胆# #CorrectScore# #FootballPredictions# #BettingTips# #MatchDay# #LiveOdds# #Handicap# #Draw# #SoccerPicks# #完结篇# #大户稳胆# #破咒之战# #teo8933#
顯示更多
🚨 【英冠雷霆】明晨03:00独狼爆发!狼队死卡一球生死线,闪电精炼拆解上盘“减热神盘”! 📊 [Market Track / 筹码视点] 英冠首轮联赛即将来袭,狼队 (Coventry/Wolverhampton,依即时指数译名) 坐镇主场,死磕传统硬骨头布莱克本 (Blackburn)。 全网散户资金天然盯着狼队的名气。但看外围即时骨架,庄家举起的终极屠刀已经彻底暴露! 🎭 [Series Inversion / 盘面闪电拆解] 盯着这张外围即时盘口,庄家操盘手在让球骨架和水位转换上的核心意图极为狠辣,绝无半点拖泥带水: 死卡 1.0 的“满水强阻”:全场让球盘口中,狼队在主场被死死顶在主让一球 (1.0) @ 0.98 满水的高位! 而在平半的变盘线上,机构甚至开出了主让半一 (0.5/1) @ 0.72 超低水。 极致的对冲防御: 机构故意用一球盘的近乎满水强行制造上盘危险、无力大胜的假象,实际是在逼迫热量流向客队受让下盘。 这正是最经典的“高水强阻,暗度陈仓”!全场独赢主胜死卡在 1.57 的强防范位,庄家底层逻辑极度防范主队直接赢球接管比赛。 🌋 [Cross Hedging / 大小球强力对齐] 昨晚我们在大球吃了亏,今晚我们极度精细。看全场大小球,机构死死退防卡在 2.5 球 @ 0.87 的低水线! 这证明主流资本在底层逻辑上,极度看好主队在90分钟内通过高效率的铁血控场实现单方面完胜零封。 客队一球受让满水,完全是机构为了拉散户接盘释放的 Value Trap(吸金毒药)! 🎯 最终防御通道(Portfolio Allocation): 这一场英冠揭幕闪电战中,大户的资金必须跟随机构最强硬的主让半一超低水、平手防线意图。我们坚决拒绝便宜下盘,坚定站在主队这一边,一击必杀! 💰 Final Investment Tips(部署清单): 👉 🔥 Premium Pick(主推):狼队 (主让半一 / -0.75) 【水位 0.72,或求稳直接独赢】 🛡 机构让球骨架防范极深,独赢低赔异常坚决,主场战术天然克制,坐半望全利落收米! 👉 💣 Alternative Option(副推):Total Goals Under 2.5【全场2.5小球 @ -0.97】 📈 大小球生命线死卡2.5低水,揭幕战两队极度谨慎,坚决严控小球防线,2-0 剧本概念极大。 👉 [Exact Score Matrix]:2-0 / 1-0 / 3-0 🎯 (全面对齐2.5小球与主队穿盘!精准锁死主队零封、大胜对手的大局剧本,用最冰冷的攻击数据,让盲目追捧客队受让名气的筹码血本无归!) #足球# #英冠# #今日足彩推荐# #每日球评# #狼队# #布莱克本# #比分波胆# #CorrectScore# #FootballPredictions# #BettingTips# #MatchDay# #LiveOdds# #Handicap# #大户稳胆# #连红争霸# #teo8933#
顯示更多
🚨 【Deep Trap】德乙风暴眼!基尔高丁惨遭“满水拦截”,明晨大户资金随机构死卡“绝防通道”! 📊 [Market Track / 席位筹码透视] 今晚 00:30(明晨 12:30AM),德乙联赛迎来新赛季的一场焦点暗战——基尔高丁 (Holstein Kiel,图中译为基尔高士丁) 坐镇主场,决战铁血名门圣保利 (St. Pauli)。 在全网普通的散户、传统大户以及盲信两队历史声望的球迷眼里,圣保利作为德乙极具拉力的硬汉球队,即便客场作战也天然自带吸金光环。无数人都在盯着圣保利不败的客场性价比。 然而,仔细切开这张外围临场的即时骨架,庄家最冷酷的筹码绞杀阴谋已经全部败露! 🎭 [Series Inversion / 种子盘面深度洗牌] 盯着这张最新外围即时盘口,庄家操盘手在让球骨架和水位转换上的致命暗示被彻底揪了出来: 死卡 0/0.5 满水的“诱上陷阱”:在全场让球盘口中,基尔高丁在主场虽然强开出了主让平半 (0/0.5),但主队水位竟然被强行顶到了 -0.92(近乎满水)!相反,客队圣保利受让平半的水位被死死压在 0.82 的低水安逸区。 在散户眼里,主队满水意味着赢球希望极其渺茫,极容易被赶往“客队保平即赢一半”的下盘。这正是最阴险的“高水强阻”。机构故意用超高水位强行构筑主队的危险假象,实际是在逼迫热量流向圣保利! 平手盘骨架的“暗度陈仓”: 再看下面一行的平手盘口,主队平手水位卡在 0.80 的超低水,客队则是 -0.90 的满水。 在独赢盘中,主胜赔率 2.36 也处于强烈的防范区间。这说明主流资本在底层逻辑上,根本不相信圣保利今天能在客场带走胜利。客队平半受让的低水,完全是机构为了让重注散户接盘而释放的 Value Trap(名气吸金毒药)! 🌋 [Cross Hedging / 流动性防火墙对冲] 把两队的战术近况底牌层层剥开,基尔高丁这支球队在新赛季的中前场压迫极强,边路反击的闪电速度极其克制圣保利沉重、笨拙的防线。 今天圣保利来到客场,其唯一的战略目标就是控节奏、死守平局。然而,基尔高丁一开场就会凭借极强的主场身体对抗全面前压,用高强度的饱和攻击去撕扯圣保利的防线。 昨晚我们在大球上吃了亏,今晚我们保持绝对的冰冷与理智:看全场大小球,机构从 2.5/3 球死死卡在 2.5 球 @ 0.82 的极低水,这证明机构在后市极度防范一场一球定乾坤的闷杀窒息局。 圣保利一旦在客场攻防失衡,90分钟内必将被主队边路的闪电战彻底击穿! 🕵️‍♂️ [Matrix Trapping / 波胆防火墙聚拢] 再看最核心的波胆防御通道:主队 1-0 赢球(8.8)、2-1 赢球(8.5) 赔率处于全场最低的防范位。 而任何带有客队大胜的波胆赔率全部大幅反弹不设防。这意味着明晨的收割剧本已经被资本死死卡住——圣保利将在客场遭到最严密的战术压制,基尔高丁将用一场利落的完胜或走盘,直接接管比赛! 🎯 最终防御通道(Portfolio Allocation): 作为今晚周五全新联赛周期的第一杆重枪,我们绝对不要掉进圣保利客场受让低水的温柔乡。 我们要跟随机构最真实的主让平手超低水意图,坚定地站在主队这一边,开启今晚的连红浪潮! 💰 Final Investment Tips(部署清单): 👉 🔥 Premium Pick(主推):基尔高丁 (平手盘 / 0) 【水位 0.80】 🛡 放弃平半满水的波动风险,平手超低水保底,主场战术天然克制,坐和望赢利落收米! 👉 💣 Alternative Option(副推):Total Goals Under 2.5/3【全场2.5/3小球 @ 0.86】 📈 严防两队陷入中场拼抢的阵地拉锯战,今晚大小球严控防线,主队一球小胜控盘的小球概率极大。 👉 [Exact Score Matrix]:1-0 / 2-1 / 1-1 🎯(精准锁死主队独赢完胜、或者 1-1 走盘的全天候防御剧本,让盲目跟风圣保利名气的筹码血本无归!) #足球# #德乙# #今日足彩推荐# #足球推荐# #每日球评# #基尔高丁# #圣保利# #比分波胆# #CorrectScore# #FootballPredictions# #BettingTips# #MatchDay# #LiveOdds# #Handicap# #Draw# #SoccerPicks# #大户稳胆# #连红争霸# #teo8933#
顯示更多
一片冰凉 前几天一直有读者留言催我,这个月的70城数据是不是忘记更新了? No,我没忘,我每天都有去统计局的网站上刷,是他们这个月更新的特别晚,一直到今天才发了9月份的表格,我马上就搬过来了。 惯例给新读者讲讲怎么看,环比99就是比上个月跌了1%,同比95就是比去年这个月跌了5%。 70个城市环比同比全部下跌,无一例外。环比北京-0.9%、上海-1%、广州-0.8%、深圳-1%,和我预期的差不多。 可能有些读者觉得这1%不到的跌幅也不算很多,但要注意这是环比,一个月跌1%一年就是12%,房价的12%对普通家庭已经是很庞大的巨款。前几年中国一线城市买房收入比普遍在25-30,就是要用25-30年的家庭收入去买一套房,那反过来可以推算,房价的12%已经相当于3-4年的家庭收入。 自己打工辛苦挣一年的薪水,结果房价跌了三四年,这就是为什么这几年中产阶级普遍有财务焦虑的原因。房价虽然不卖就不亏,但信心被重创了,没有安全感。 从目前的趋势来看这个冬天也很难有什么好转,房价最快要到明年开春可能才会企稳。政策上能打的牌前面都打完了,全国现在只有北京上海这两城市还有一些象征性的限购,但即便全取消了也就那样。 接下来可能会降息,昨天已经有部分小银行下调了存款利率,机构开始吹风年底之前降息0.1%。其实我认为房贷利率要下调到2.5%以内才有效,也就是目前的位置再下调0.5-0.6%,0.1%太少,但利率下调受息差控制,不是想调就能调。 中国的负通胀和消费萎靡我觉得和房地产去杠杆有很大关联,所以在楼市企稳之前消费板块大概率是好不起来的,我觉得这可能是明年的叙事。 最后顺带一说,本月的LPR持平,1年期和5年期都不变。 …… 今天a股迎来了回暖,所有宽指都反弹,中位数上涨1.06%,但也有个很大的问题,两市的成交量只有1.74万亿,过去两个月都没出现过这么低的量。缩量反弹往往被视为弱势反弹,显示了目前的市场信心还远没有恢复。 板块里涨最多的是煤炭+5%、燃气+4.3%,这绝对算一对稀客,炒作的逻辑是预热入冬采暖。话说这几天北京真特么冷,我在书房打字手都冻麻了,要开戴森的暖风来吹才行。但冷归冷,供暖时间也没听说会提前,供暖总量每年都是差不多的,往年炒供暖的时间窗口都很窄,这次我觉得也不会例外,不要恋战。 另外今天机器人板块表现活跃,其实从上周特斯拉50亿三花智控订单的小作文开始,就明显感觉到场内一些热钱开始转战机器人概念,那天三花智控打板的有章建平的6.8亿,第二天虽然辟谣了但是只跌了不到3%,大佬多半没走。ai和电池最近热度下降,可能就是由于部分炒作资金在板块之间流动。 今天a股只有黄金板块遭遇重锤,跌幅超过7%,这个节奏完全跟着国际金价走,周五晚上金价回调2.5%,今天黄金股就数倍放大跌幅。不过这不是太大问题,因为今晚黄金又拉回了4340,明天黄金概念肯定能回血。但我还是觉得这个位置炒黄金股的值博率不高,金价今年涨了50%多,黄金股板块今年涨了95%,已经预支了很高的估值和市场情绪,缺乏性价比。 总的来说今天能回一波血肯定不是坏事,但在k线趋势和量能上都没有解决问题,后续应该还有考验,得再往下看看。 …… 1、宁德时代第三季度净利润185亿,增长41%,营收1042亿,增长12.9%。这个业绩当然很劲爆,比市场预期的170-175亿还要再高一点。市场预期全年利润660亿左右,目前三个季度已经达成490亿,四季度看趋势还能再往上拱一拱,最终落在670-680区间。 2、越南股市今天大跌5.6%,越南政府监察局公布了对67家债券发行人(包括5家银行)的检查结果,发现存在多项违规行为。其中,越南第二大地产商 Novaland集团相关案件已移交公安部。越南VN指数里14只银行股8个跌停。越南这些年摸着我们过河,形似神似学到了七八分,连房地产暴雷这个副本也成功复刻,真是每一条弯路都不愿错过。 3、今天吃到一瓜,周杰伦有个姓蔡的魔术师朋友,给他1亿多新台币(大概2000多万人民币)帮忙投资比特币,周杰伦自己的说法是对方替自己“代持”,结果这几天这个蔡魔术师联系不到了,跑路了。周杰伦在社交媒体上让他赶紧出现,不然就完了。 周杰伦自己很喜欢变魔术耍酷,估计是兴趣爱好交的朋友,但不理解为什么要一个魔术师替自己炒币,台湾出金入金又不用担心被冻账户 4、前三季度GDP5.2%,这是好事啊,年内5%的目标眼看着无惊无险又要轻松达成了,一切尽在掌握,稳中向好。 就这些吧,发射!
顯示更多
📊🚨 巴西甲数据精选:明日31号 早上06:30AM 压轴资本异动 哥连泰斯SP vs 巴拉纳体育会 Real-Time Odds Analysis 👥 主队哥连泰斯拥有 home advantage(主场优势), 目前全场让球深开在 主让0.5球 (odds -0.98),机构对其整体胜出持有高水阻击态势。 附加盘口中更有机构退到 0/0.5球 (0.69) 的低水区间疯狂吸纳下盘筹码,资金两端试探极其凶猛。 最值得高度关注的是,Over/Under(大小球)与 Correct Score(波胆)之间再次形成了极为隐蔽的对冲形态! Although the Total Goals line sits shallowly at 2.0 with a 0.90 water (虽然大小球大盘仅仅浅开在 2.0 球且高水,明面上在疯狂营造沉闷沉寂的卡盘假象) But look closely at the Matrix Overview below! 👇 📋 核心波胆临场深度博弈:Correct Score 热门比分: 目前机构对主胜 1-0(赔率 5.2)和 2-0(赔率 7.7)进行了近乎变态的筹码死锁! 平局方格中,1-1 同样被死死卡在 6.2 的极限低赔! 操盘手终极研判:大盘强行开出 2.0 球的极浅大小球大盘,配合高水, 在疯狂把资金往“绝无进球、闷战全场”的死局方向诱导。然而最底层的波胆矩阵里, 1-0(5.2)和 1-1(6.2)的防范力度完全超出了正常 2.0 球盘口的常规配比。 这形成了教科书般的 “大盘看扁进球,波胆死守单边” 的资本陷阱(Trap Game)。 明早两队绝非一潭死水,机构大概率在利用 2.0 球大盘分流热度, 实则暗中防范主队 1-0 零封一球卡盘,或者 1-1 针锋相对的平局僵局! #CampeonatoBrasileiro# #巴甲# #FootballAnalysis# #SportsData#
顯示更多
U12中国足球小将意大利欧洲夺冠(SIGISMONDI杯,2026.6.2) 赛事概况 赛事在意大利举办,号称U12年龄段“小世界杯”,48支全球顶尖青训梯队参赛,云集英超埃弗顿、意甲佛罗伦萨、葡超布拉加、丹麦哥本哈根等欧洲豪门青训梯队;队伍为董路带领的中国足球小将2014队(平均10-12岁),7战全胜拿下冠军,总进21球仅丢2球。 完整赛程战绩 小组赛(3战全胜、零失球,轰14球) 1. 2-0 意大利TTT ​ 2. 5-0 丹麦哥本哈根 ​ 3. 7-0 GGR队 淘汰赛(连克欧洲五大联赛豪门梯队) 1. 3-1 意甲佛罗伦萨 ​ 2. 1-0 葡超布拉加 ​ 3. 2-0 哥本哈根(半决赛) ​ 4. 决赛:常规1-1埃弗顿,点球5-4绝杀夺冠 门将陈思源点球大战两度扑点,小将孟新艺罚入制胜点球。 夺冠意义 1. 继2018年小将09梯队德国夺冠后,时隔八年中国民间青训再度在欧洲顶级少年赛事登顶; ​ 2. 民间自费青训走出成果,是中国青训亮眼突破,赛场华人现场高举五星红旗庆祝
顯示更多
2026年,还在银行定存当通胀大冤种?HTX火币赚币数据给你算明白 一、先算一笔所有人都看得懂的账:银行vs火币,差距到底有多大? 先上两组2026年的真实利率数据 📎国有大行一年期定存:年化0.95%,活期0.05%,连通胀(1.2%)都跑不赢,100万存一年,实际购买力反而缩水2500元 📎火币USDT活期:新用户首笔0-500USDT档位年化10%,500USDT以上也有2.5%;VIP档位5-10万USDT区间,年化直接拉到6%-9% 直接算给你看,100万本金,两种选择的差距 📎银行定存:年利息 9500 元,扣除通胀后实际亏损 2500元 📎火币USDT VIP活期(按中间值 7.5% 算):年利息75000元,扣除通胀后实际净赚63000元 同样100万,放银行一年亏本金,放火币一年躺赚6万+,是银行收益的7倍多。 二、不止USDT,全品类稳定币活期收益全面碾压 📎USDC活期:固定年化5.00%,随存随取无锁仓 📎USDE活期:固定年化5.00%,和USDC收益持平 📎USDD活期:年化4.25%,稳定币赛道里的高收益梯队 📎USD1活期:0-500USDT档位年化15%,500USDT以上仍有4%,新用户专属福利直接拉满 对比银行活期0.05%的利率,火币稳定币活期的收益,是银行的80-100倍,而且资金随进随出,没有定存的锁仓限制。 数字不会骗人,2026年的低利率时代,钱放着不动就是在被通胀悄悄稀释。 #火币赚币# @justinsuntron @HTX_Molly
顯示更多
0
17
15
1
轉發到社區
投机解码的 drafter 从来都是一个 token 一个 token 地猜。做出 DFlash 的推理公司 Inco AI 说这没必要:正确的 token 本来就在候选列表里,整块并行预测之后挑出一条连贯路径,输出不变,每次验证多赚一个完整的 token。 《DFlash 2:保持并行起草》 推理是 agent 时代的瓶颈。agent 会读、会规划、会调用工具,常常一跑就是几小时甚至几天。它们消耗 token 的速度,是聊天场景从未达到过的。而每一个 token 都要在模型上跑一次完整的前向传播。在 Inco AI,我们在构建一套面向未来 token 经济学的推理栈。这篇文章是一次预览。 我们的团队 1 月发布了 DFlash(论文: SGLang、vLLM、TensorRT-LLM 和 llama.cpp 里。NVIDIA 在 Blackwell GPU 上用它测到了最高 15 倍的吞吐;Google 报告在 TPU 上每秒 token 数提升 3 倍;CoreWeave 生产环境的 Kimi K2.7 Code 端点(Artificial Analysis 上该模型最快的端点)默认就跑 DFlash。生态已经在它之上构建:NVIDIA、Red Hat、Modal 都发布了 DFlash drafter;Meta(Muse Glimmer)、Poolside(Laguna)、小米(MiMo-V2.5-Pro)、NVIDIA(Nemotron 3.5 Lightning)随自家模型发布官方 drafter。在 Hugging Face 上,DFlash 模型被下载了超过 350 万次(截至 2026 年 8 月)。 投机解码是现代推理栈的核心组件之一。一个小 drafter 模型猜出一整块 token,目标模型在一次前向传播里验证整块。猜得好,一次前向变成多个 token;猜得差,丢掉重来。但多年来,起草本身一直是自回归的:一次一个 token。DFlash 让它也变成了一次通过:整块、每个位置,并行预测。 (演示视频:DFlash 2 在 Apple M5 Max 上用 oMLX 为 Qwen3.8-27B 起草,与自回归解码并排对比。 DFlash 2 把并行起草又往前推了一步:每次验证通过多产出 20% 以上的输出,增加的周期延迟只有约 1%,而输出可证明不变。跨基准测试的增益在 16–25%。配合今天发布的 Qwen3.8-27B drafter,SGLang 在 batch size 1 下达到自回归解码 2.7–3.4 倍的吞吐。每个位置独立预测,留下两处空间:选对 token,以及在块的末尾守住准确率。DFlash 2 把这两处都拿了回来,同时没有放弃一次性通过的设计。 现在就能跑 DFlash 2 已经跑在主流推理引擎里。 SGLang: pip install -U "sglang[all] @ git+" python -m sglang.launch_server \ --model-path Qwen/Qwen3.8-27B \ --speculative-algorithm DFLASH \ --speculative-draft-model-path incoai/Qwen3.8-27B-DFlash2 \ --speculative-num-draft-tokens 8 vLLM: pip install -U "vllm @ git+" vllm serve Qwen/Qwen3.8-27B \ --speculative-config '{ "method": "dflash", "model": "incoai/Qwen3.8-27B-DFlash2", "num_speculative_tokens": 7 }' llama.cpp: git clone cd llama.cpp git fetch origin pull/27342/head:pr-27342 git switch pr-27342 NVIDIA CUDA cmake -B build -DCMAKE_BUILD_TYPE=Release -DGGML_CUDA=ON cmake --build build -j Apple Silicon cmake -B build -DCMAKE_BUILD_TYPE=Release -DGGML_METAL=ON cmake --build build -j ./build/bin/llama-server \ -hf ggml-org/Qwen3.8-27B-GGUF:Q4_K_M \ -hfd incoai/Qwen3.8-27B-DFlash2-GGUF:Q4_K_M \ --spec-type draft-dflash \ --spec-draft-n-max 7 oMLX:下载安装支持 DFlash 2 的预构建版( 在 oMLX 里跑 Qwen3.8-27B 加 DFlash 2: 1. 打开 oMLX 的 Model Downloader,下载 mlx-community/Qwen3.8-27B-4bit 和 incoai/Qwen3.8-27B-DFlash2。 2. 打开 Model Manager,编辑 mlx-community/Qwen3.8-27B-4bit,配置 DFlash: • DFlash:enabled • Draft model:incoai/Qwen3.8-27B-DFlash2 • Draft quantization:enabled • Runtime block size:5 • Verify mode:dflash 3. 保存设置,加载目标模型。 对的 token 早就在候选里 DFlash 每个位置独立、并行地预测。每个选择单独看都合理,但没有什么让它们彼此咬合,一个不连贯的块会在验证时被截断。近期的方法如 Domino 和 DSpark,用顺序的 Markov head 重写每个位置的完整词表分布来买连贯性。但真的需要这种昂贵的自回归纠错吗? 不需要。证据就在 DFlash 自己的候选列表里。拿第一个位置来说:DFlash 的第一选择 85.4% 的情况下是对的,但正确的 token 99.5% 的情况下都在前 16 个候选里。即使第一选择错了,对的 token 通常也在列表上。 表 1:Recall@1(第一选择正确的概率)与 Recall@16(正确 token 出现在前 16 候选里的概率),按起草位置统计,条件是前面每个位置都正确。GSM8K 上的五层 Qwen3-4B DFlash。接受长度包含验证器产出的下一个 token。 • 位置 0:Recall@1 85.4%,Recall@16 99.5% • 位置 1:80.3%,97.3% • 位置 2:79.4%,94.8% • 位置 3:78.3%,92.6% • 位置 4:77.5%,90.8% • 位置 5:75.9%,89.4% • 位置 6:72.9%,87.8% • 接受长度:4.27(只看第一选择);6.79(从前 16 里选) 一个总能从前 16 个候选里挑对的那个 oracle,会把接受长度从 4.27 抬到 6.79。这个差距是纯粹的选择空间。我们只需要在候选里选出一条正确的路径。 图 1:一个周期里的选择器。只用 DFlash,每个位置保留自己的第一选择;这里两个相邻位置选了同一个词,结巴在验证时死掉。DFlash 2 保留每个位置的 top 候选,选择器在候选之间走出一条连贯路径;这里整块都活了下来。 一个轻量的路径选择器 连贯性大体是局部的:一个候选合不合适,主要取决于它前面的那个 token,所以给相邻对打分应该就够了。DFlash 2 保留每个位置前 16 个候选,给每一对相邻候选打分。对前一个 token a 和当前候选 b: S_t(a,b) = U_t(b) + ⟨A(a)⊙H(h_t), B(b)⟩ 分数分两部分。第一部分 U_t(b) 是 DFlash 自己的 logit:drafter 本身有多喜欢 b。第二部分问 b 接在 a 后面有多顺:A 和 B 给每个 token 一个紧凑的 256 维嵌入,两个嵌入在一个上下文门控 H(h_t) 下匹配,门控决定匹配的哪些部分算数。本质上,这是对相邻候选做的低秩双线性注意力。 打分全程并行。每个位置的每一对相邻候选一次性全部算完,不需要额外的 backbone 或 LM head 前向。唯一串行的部分,是最后在预计算好的分数上走一遍:从最后一个已验证 token 出发,贪心地跟着每一步最好的后继走,采样从同样的分数里抽取,拒绝采样恢复出精确的目标分布。 表 2:只加路径选择(不加卷积)的接受长度,GSM8K 上的五层 Qwen3-4B。开销相对纯 DFlash:drafter 增加的参数、起草-验证周期增加的延迟。 • DFlash:T=0 下 4.27,T=1 下 3.78 • + DSpark 纠错:+77.8M 参数,+9.6% 延迟;4.49,4.08 • + 路径选择(我们的):+2.0M 参数,+0.6% 延迟;4.61,4.25 选择器在 T=0 下给 DFlash 加 0.34 个 token,T=1 下加 0.47。两个设置下都超过 DSpark 的纠错,参数少约 40 倍,延迟开销低 16 倍。选择比预测便宜。而且还有空间:oracle 能到 6.79。成对打分是我们能想到的最简单的选择器,我们相信这里还有很多可探索的。 后缀衰减是个局部问题 我们还注意到上面两行 recall 都在块尾下滑。连 oracle 都在衰减:即使选择完美,准确率仍然从第一个位置的 99.5% 掉到最后一个位置的 87.8%。没有选择器能修这个,因为候选自己就不够了。我们把这个叫后缀衰减,它是 backbone 的问题。 一个嫌疑是容量:五层 backbone 可能太小,撑不住横跨整块的依赖。如果真是这样,深度应该在靠后的位置帮上最多的忙。事实也如此:3 层、5 层、15 层的 DFlash 模型在第一个位置上几乎一样,越往块尾分得越开。但深度不加区分:多十层 attention block 到处加容量,连那些没什么可赚的靠前位置也加,把 DFlash 吸引人的那部分效率磨掉了。 图 2:GSM8K 上 Qwen3-4B 的 Recall@1(T=0),条件是前面每个位置都正确。所有 drafter 在相同设置下训练;卷积模型评估时不带选择器。它的卷积增加 3% 参数和 0.7% 周期延迟;15 层模型多出的十层增加 15.2%。 我们要一个有针对性的修法,而 DFlash 的 attention 指出了修哪里。它有两份工作:读块之前的上下文,以及建模块内部的依赖。但它在第二份上花的越来越少:块内注意力占比从第 1 层的 30% 掉到第 5 层的 8%,剩下的还集中在越来越少的一小撮 head 里。所以我们把两份工作拆开:一个专用模块承担块内工作,attention 继续读上下文。 图 3:五层 Qwen3-4B DFlash 的块内注意力按 head 分布。越亮的格子代表在起草块上花注意力越多的 head;靠后的层里,块内质量收缩、集中到少数几个 head。 一个轻量的局部卷积 块内工作本来就是短程的:一个块只有 4 到 16 个 token,最紧的依赖坐在相邻位置之间。自然的算子是短卷积:两个抽头,一个在当前位置,一个够到前一个位置,权重随内容自适应。跟随 Canon Layers、Dynamic Short Convolutions 和 Convolution for Large Language Models 的做法,我们在每个 attention 和 feed-forward 子层前后插入这个双抽头动态深度卷积: Conv_k(x)_t = k_{t,0}⊙x_t + k_{t,1}⊙x_{t-1} 每个系数由一个可学习的基核加上从当前隐藏状态算出的一个小修正组成;每 16 个通道共享一个修正。第一个位置读最后一个已验证 token 的表示,之后的每个位置读它前一个的。信息穿过整块,同时所有位置仍然并行计算。 图 4:双抽头动态卷积。每个 drafter 层的每个 attention 和 MLP 子层前后各有一个。内部:每个位置把自己的表示和前一个的混合;第一个位置读最后一个已验证 token。 卷积是块局部的、无状态的,所以能无缝插进 DFlash,不用动 attention、LM head 或验证。 只加 16.5M 参数(3%),带卷积的五层 DFlash 就逼近了 15 层 DFlash,大幅减轻后缀衰减。卷积给起草-验证周期延迟加 0.7%;多十层 Transformer 层加 15.2%。第 4、5 层的平均块内注意力从 9.4% 降到 0.5%,与卷积吸收局部工作、attention 回到读上下文一致。一个只够到前一个位置的核,买回了十层额外层的大部分收益:后缀衰减大体是个局部问题。 合在一起 到目前为止,选择器和卷积是分开测的;下面的完整对比把它们放在一起。DFlash 和 DSpark drafter 是我们在对齐的设置下自己训练的,MTP 随模型发布。 表 3:Qwen3.5-4B 每请求平均接受长度。采样:thinking 开启,温度 1.0,top-p 0.95,top-k 20,presence penalty 1.5,无损拒绝采样。 • GSM8K:MTP 4.78,DFlash 4.99,DSpark 5.69,DFlash 2 6.20 • MATH-500:5.04,5.42,6.20,6.76 • HumanEval:4.84,5.43,5.80,6.28 • MBPP:4.16,4.49,4.96,5.41 • MT-Bench:3.90,4.26,4.77,5.20 • 平均:4.54,4.92,5.49,5.97 DFlash 2 在每项基准上都领先。平均下来,它比 DFlash 多 1.05 个 token(21%),比 DSpark 多 0.48。升级仍然便宜:选择器和卷积加起来,只给五层 DFlash 的起草-验证周期延迟加了 1.3%。 在 MATH-500 上,增益逐位置可见:DFlash 2 到最后一个位置都稳在 86% 附近,而每个基线在块尾都比它低 6 到 9 个点。 图 5:MATH-500 上 Qwen3.5-4B 的条件接受率,采样同上。 两个 drafter,今天发布 我们今天发布两个 DFlash 2 drafter:一个给 Qwen3.8-27B( Meta 的 Muse Glimmer( Qwen3.8-27B,我们对比模型原生的 MTP 路径和一个社区 DSpark drafter。 表 4:Qwen3.8-27B 每请求平均接受长度,模型默认采样、块大小 8,对比原生 MTP 路径和社区 DSpark drafter。 • GSM8K:MTP 5.02,DSpark 4.36,DFlash 2 5.46 • MATH-500:4.72,3.92,5.28 • HumanEval:3.91,3.30,4.39 • MBPP:3.99,3.51,4.79 • MT-Bench:3.74,3.01,4.10 • 平均:4.28,3.62,4.80 对 Meta 的 Muse Glimmer,我们对比随模型发布的官方 DFlash drafter 和一个社区 DSpark drafter。 表 5:Muse Glimmer 每请求平均接受长度,模型默认采样、块大小 16。DFlash 是 Meta 随模型发布的官方 drafter;DSpark 是社区 drafter。 • GSM8K:DFlash 5.43,DSpark 5.45,DFlash 2 6.57 • MATH-500:5.39,5.01,6.56 • HumanEval:4.11,4.33,5.66 • MBPP:3.74,4.02,5.30 • MT-Bench:3.52,3.59,4.42 • 平均:4.44,4.48,5.70 差距很大:在两个模型上,DFlash 2 平均比 DSpark 多出超过一个完整的 token。它也超过每个模型的官方 drafter:Qwen3.8-27B 的 MTP、Muse Glimmer 的 DFlash。换算成吞吐,Qwen3.8-27B 上达到自回归解码的 2.7–3.4 倍,Muse Glimmer 上 3.1–4.6 倍。模型卡( 底线 agent 一个下午写出来的东西,聊天机器人要写一个月,而每一个 token 底下都坐着解码。DFlash 2 以接近自回归解码 3 倍的速度解码,每个 token 约三分之一的算力,输出相同。 七个月里,DFlash 从我们的论文变成了行业标准,超过 350 万次下载。在同一个设计内部,DFlash 2 每次通过多解码一个完整的 token,免费。那还只是服务栈的一个组件。推理离它的地板还很远。 在 Inco AI,我们在构建一套端到端的服务栈,把这个地板继续往下压。DFlash 2 是第一块。两个 drafter 今天发布在 Hugging Face。 如果你在规模化地服务 agent,想在你的栈里评估 DFlash 2,或者想为你跑的模型(包括你自己的微调)要一个 drafter,写信给我们:contact@inco.ai。 我们也在招人。如果你想一起构建这套栈,联系我们。 把候选连起来。起草,继续并行。 脚注:Modal 的 Speculation Is All You Need 指出,投机解码是对低延迟服务最重要的优化。我们是他们工作的超级粉丝,感谢他们自 DFlash 发布以来的支持和讨论。 本文引用格式:@misc{inco2026dflash2, title={DFlash 2: Keep Drafting Parallel}, year={2026}, month={August}, url={ 原文: #DFlash# #投机解码# #LLM推理#
顯示更多
0
46
33
2
轉發到社區