註冊並分享邀請連結,可獲得影片播放與邀請獎勵。

檢索結果 51 工具を愛してほしい♥
51 工具を愛してほしい♥ 貼吧
一個關鍵字就是一個貼吧,路徑全站唯一。
建立貼吧
用戶
未找到
包含 51 工具を愛してほしい♥ 的搜尋結果
同一批基准里,本地跑的 DeepSeek V4 Flash 加上 J-Space 控制层之后,在大多数任务上压过了不加控制层的 V4 Pro。 《DeepSeek V4 × J-Space 能力释放报告》 DeepSeek V4 × J-Space:Benchmark 与工程观察记录 © 2026 Tiger3807861189,本记录采用 CC BY-ND 4.0(署名-禁止演绎)许可。 页面范围:本记录整理外部项目已经公开的工程观察、J-Space 使用的操作性术语、项目级 Benchmark 分数及其适用边界。它不是研究论文,非学术性质,不提供模型内部机制证明、形式化判定方法、消融设计或因果贡献分解。 J-Space Cognition Suite V3.6 是一套在推理阶段运行的模型无关控制系统,不修改模型权重。项目地址: 一、外部工程观察 1.1 Anchored Standard:首轮接口锚定 dsh-anchored-standard( DeepSeek Harness 的首轮接口条件。其基础方案在第一次模型请求中恢复 Minimal 的真实双工具 Schema,抑制自动注入内容;会话产生持久事件后,再开放一个较小的常驻工具目录,并按需解锁其他工具。 该项目的公开实验表明,首轮工具 Schema、输出预算和自动注入内容都可能改变首条推理轨迹。它也明确区分了"轨迹被锚定"和"任务能力已经稳定提升":当前仓库中的通用组合与早期高分运行并不完全相同,小样本独立复现尚不足以确定稳定的能力增益幅度。因此,本记录只引用其接口敏感性与路径保持观察,不把单项分数推广为普遍结论。 1.2 Routing Suite:任务感知的入口选择 dsh-routing-suite( 与工具面装配,把新会话送入不同的行为带。其公开材料报告了稳定区域和不稳定过渡区域,并据此避免把连续数值旋钮误当成可连续调节的推理深度。 该项目后来对早期"官方刻意设计双吸引子""自路由绝对不可能"等强归因作出了公开勘误( mixed 表示不稳定的过渡或竞争区域,不等于一种兼具短、长思维优点的可用中间态。 二、思维链二极管 2.1 操作性定义 本记录所称思维链二极管(chain-of-thought diode),是一个面向黑盒行为的工程术语:在同一个会话中,连续思维链会稳定落入以下两种形态之一: • 短思维直觉:较快形成判断并进入行动,推理块较短; • 长思维推理:先展开较长的分析、重估与规划,再决定是否行动。 两种形态在同一会话中不能稳定、按任务阶段自然地共同出现;首轮形成路径承诺后,后续思维链通常延续同一侧。外部实验中偶尔出现的词汇混合或不稳定过渡,不构成能够同时利用两侧优势的中间态。 这一术语描述的是会话级轨迹,而不是某一句话或某一个词。We need、Let me 等表达最多只能作为外部探针,不能单独证明模型能力、推理质量或内部状态。 2.2 形成原因:极简接口过拟合假说 J-Space 采用的工程诊断是:DeepSeek 的 Agent 后训练行为可能与 DSH 极简模式的接口分布形成了过强耦合。极简 persona、首轮工具 Schema、自动注入边界和输出条件共同构成接口指纹;当实际 Harness 接近这一分布时,一类轨迹更容易被唤起,接口发生变化时则可能落入另一类轨迹。 这里的"过拟合"是对黑盒条件敏感性的工程概括,不表示已经获得 DeepSeek 的训练数据、隐藏状态或官方内部解释。现有公开证据支持"接口条件与轨迹变化相关",但不足以从外部还原完整训练机制。 2.3 两侧的结构性弊端 • 短思维直觉:过早接受第一个流畅解释;复杂约束整合不足;跳过必要中间桥接;工具证据利用不足;局部测试成功后过早宣布完成。 • 长思维推理:分析惯性和行动延迟;反复推翻或重建已有判断;工具调用过晚;Token 与时间消耗增加;长程状态漂移;信息已经充分仍难以收束。 因此,二极管带来的主要工程问题不是某一侧必然更差,而是会话无法随任务阶段稳定调整推理形态:需要桥接时可能过快,需要行动时又可能持续推演。 三、三套方案的浅层关系 • Anchored Standard:作用于首次模型请求的接口条件。恢复已知的 Minimal 接口指纹,尽量让会话从入口进入并保持一条稳定轨迹。 • Routing Suite:作用于新会话开始前的任务分类与模式选择。根据任务选择较适合的稳定行为带,并回避不稳定过渡区域。 • J-Space:作用于会话进入轨迹后的完整任务生命周期。不宣称消除二极管,而是通过状态、行动、验证与恢复机制缓解会话落入任一侧后的结构性弊端。 三者可以被理解为入口恢复、入口选择和持续任务控制三个不同层面。这是一种便于工程使用的关系整理,不表示三套方案已经在统一 Harness 下完成组合实验,也不构成效果排名。 3.1 J-Space 对两侧弊端的浅层处理 当会话偏向短思维直觉时,J-Space 使用 bridge-before-conclusion、共享约束广播、Empirics、verifier 与 coverage,要求快速判断在交付前补足必要桥接、证据和验证范围。 当会话偏向长思维推理时,J-Space 使用功能性第一人称、明确的 Next、有限候选、差分测试与 checkpoint,把已经形成的判断绑定到行动、取证或收束,减少无新增约束的反复推演。 对于两种形态,Goal / Core / Verified / Open / Next 账本、工具接缝刷新与恢复机制负责维持跨文件、跨工具和长时间任务状态。这些机制调节外部任务过程,并不等同于让模型在同一会话中自由切换两种底层思维链。 四、Benchmark 记录 4.1 评测上下文 J-Space 在 DeepSeek 上的项目评测参照官方 Harness 极简模式。J-Space 通过工作空间路由、状态连续性、验证与恢复参与推理时流程。 结果形成于项目现有的评测环境。硬件条件、进程隔离、工具可用性与信息访问边界共同构成评测上下文;可访问资料及执行轨迹也可能影响观测结果。 以下汇总上述条件下的项目级 Benchmark 记录。其他模型的数据保留各厂商公开评测时的原有上下文,不同环境与 Harness 配置下出现分数变化属于正常现象。各 Benchmark 使用自身原生分数,数值越高越好;"—" 表示没有报告结果。 4.2 分数记录 顺序固定为:V4-Flash-0731 裸跑、V4-Flash-0731 + J-Space、V4-Pro-0813 裸跑、V4-Pro-0813 + J-Space、GLM-5.3、Kimi-K3、Opus-4.8、Fable 5(带 fallback)。 • HLE(无工具):37.8、45.5、42.7、48.0、未报告、43.5、49.8、53.3(全场最高) • HLE(有工具):51.5、60.6、60.0、67.7(全场最高)、62.5、56.0、57.9、63.0 • Terminal Bench 2.1:82.7、87.1、87.9、90.1(全场最高)、88.2、88.3、85.0、88.0 • NL2Repo:54.2、70.2、61.5、73.4(全场最高)、58.0、58.0、69.7、未报告 • CyberGym:76.7、81.7、83.3、86.8(全场最高)、84.5、80.0、78.3、83.1 • DeepSWE:54.4、67.4、62.7、72.0(全场最高)、66.9、67.5、58.0、70.0 • Toolathlon-Verified:70.3、77.7、74.1、79.5(全场最高)、73.0、76.5、76.2、77.9 • Agents' Last Exam:25.2、30.1、25.7、30.3(全场最高)、28.5、27.6、25.7、23.8 • AutomationBench(Public):25.1、31.7、31.8、38.2、48.2(全场最高)、30.8、27.2、29.1 4.3 Benchmark 与二极管弊端的定性对应 • HLE(无工具):短侧可能过早下结论,长侧可能在知识边界之外无效延伸;J-Space 对应必要桥接、置信控制与独立复核。 • HLE(有工具)、CyberGym:短侧可能少用或少整合证据,长侧可能迟迟不进入工具取证;对应 Empirics、工具接缝与验证覆盖。 • Terminal Bench:短侧可能快速执行但遗漏核验,长侧可能分析过度、行动延迟;对应明确的 Next、诊断重试与 checkpoint。 • NL2Repo、DeepSWE:短侧可能丢失跨文件约束,长侧可能反复重建计划;对应共享广播、Loop 账本与持续验证。 • Toolathlon-Verified:短侧可能跳过编排检查,长侧可能困在工具选择和重新规划;对应共享状态、接缝审计与 coverage。 • Agents' Last Exam、AutomationBench:异构任务或长间隔会放大固定路径与任务阶段的错配;对应选择性 pass、持久状态与恢复。 上述对应关系是工程解释,不是从分数反推出内部状态的证明。当前 Benchmark 记录没有逐次标注会话所处的二极管状态,因此不能据此计算二极管对分数的贡献比例,也不能把全部分数变化归因于单一机制。 4.4 数据来源 • DeepSeek V4-Flash-0731 模型卡: • 智谱 AI( GLM-5.3 发布评测记录 • Kimi-K3 模型卡: • Claude Fable 5 与 Claude Mythos 5 System Card: • J-Space Cognition Suite V3.6 README: 五、适用边界 • 思维链二极管和极简接口过拟合属于黑盒工程诊断,不是 DeepSeek 官方披露的模型结构或训练事故。 • 词汇、首行风格和思维链长度只能作为轨迹探针,不能替代任务完成、工具行动、验证覆盖和得分。 • Anchored Standard、Routing Suite 与 J-Space 的关系是作用层面的整理,尚未经过统一组合实验验证。 • 当前分数是项目记录,不足以建立跨模型普遍性,也不支持精确的因果贡献分解。 • J-Space 不创造基础模型缺少的知识,也不保证对所有任务、模型或 Harness 产生正向变化。 引用:工程使用请引用 J-Space Cognition Suite V3.6( 原文: #DeepSeek# #J-Space# #本地AI#
顯示更多
做 Web 安全测试或者挖漏洞,工具散在各处,每次想找个合适的都得翻半天收藏夹。 WebHackersWeapons 这份合集把这些工具集中列出来,并按用途分好类。 收录约 359 款工具,涵盖信息收集、扫描器、模糊测试、代理抓包等工具。 GitHub: 每条都标了支持哪些系统、用什么语言写的、Star 数多少,挑的时候一眼能比出来。 另外整理了 19 个浏览器扩展,以及 51 个 Burp、Caido、ZAP 的插件。 标签分得挺细,按 XSS、SSRF、子域名这些具体方向也能直接筛。 做安全测试或者打 CTF 的朋友,可以拿它当索引用。
顯示更多
0
13
12
1
轉發到社區
上交所9只主动ETF(51开头代码)管理风格汇总: 1. 华夏质量价值甄选主动管理ETF • 风格:大盘深度价值 • 策略方法:主观价值选股+量化多因子辅助校验,属于半量化混合模式;筛选低PE、高ROE、自由现金流稳定龙头,规避高估值题材;严格分散持仓,单一行业上限20%。 • 管理方案:双基金经理(价值老将+量化分析师),「主观选股+量化风控」搭档;ETF运营团队同步负责每日PCF清单。 • 券结券商:中信证券 • 适配配置人群:长期稳健型、养老/保险中长期资金,适合底仓打底,追求低回撤长期收益。 2. 汇添富均衡策略主动管理ETF • 风格:全市场均衡分散 • 策略方法:纯均衡主观框架,搭配行业轮动量化模型;行业均匀配比,不押单一赛道,兼顾价值与成长,控制组合波动率;量化工具用于测算行业景气度轮动信号。 • 管理方案:单人核心基金经理+ETF运营后台团队辅助,无量化共管,但内置量化风控系统。 • 券结券商:申万宏源 • 适配配置人群:普通个人投资者均衡底仓,不想择时、追求平滑净值波动。 3. 易方达品质未来主动管理ETF • 风格:均衡成长(消费+高端制造龙头) • 策略方法:主观精品选股为主,少量量化因子筛选财务优质标的;聚焦长期护城河企业,适度布局成长赛道,不做短期景气炒作。 • 管理方案:单人明星权益基金经理管理,配套ETF专属运营小组;唯一非券结产品,托管银行为招商银行。 • 适配配置人群:长期持有型投资者,偏好消费、高端制造龙头,能承受中等波动。 4. 华泰柏瑞价值精选主动管理ETF • 风格:深度价值+红利双主线 • 策略方法:量化多因子为主,主观二次筛选;核心因子:低估值、高股息、低资产负债率,重仓银行、基建、高股息公用事业,全市场高分散持股数百只。 • 管理方案:双经理(量化投资总监+主动价值基金经理),标准主动量化共管模式。 • 券结券商:华泰证券 • 适配配置人群:高股息偏好、追求稳健分红收益,替代银行理财、四大行股票。 5. 摩根核心成长主动管理ETF(唯一外资公募) • 风格:核心成长 • 策略方法:主观成长选股+海外量化估值模型;聚焦科技、医药等高景气成长赛道,弱化短期波动,拉长持仓周期,通过分散降低成长股回撤。 • 管理方案:单人外资资深成长基金经理,ETF团队辅助运营。 • 券结券商:国泰海通 • 适配配置人群:能承受较高波动,长期布局科技成长、追求超额收益的进取型投资者。 6. 华安品质严选主动管理ETF • 风格:大盘高质量龙头均衡 • 策略方法:半量化,财务量化模型初筛高盈利、高现金流龙头,主观剔除景气下行行业;覆盖消费、制造、金融均衡配置。 • 管理方案:单人权益基金经理,后台量化团队辅助风控。 • 券结券商:国泰海通 • 适配配置人群:均衡底仓配置,兼顾稳健与小幅成长弹性。 7. 平安行业优选主动管理ETF • 风格:行业轮动均衡 • 策略方法:全量化行业轮动策略,宏观+行业景气双因子驱动;按月度调整行业配比,不长期押注单一赛道,自动切换高低景气板块。 • 管理方案:双基金经理(量化轮动经理+ETF运营经理),纯量化管理梯队。 • 券结券商:平安证券 • 适配配置人群:没时间自主轮动,希望靠模型自动切换行业的懒人投资者。 8. 招商价值智选主动管理ETF • 风格:价值红利融合 • 策略方法:主观价值选股,量化红利因子辅助加权;兼顾低估值修复与稳定现金分红,持股分散、低换手率。 • 管理方案:单人价值派基金经理,配套量化风控系统。 • 券结券商:华泰证券 • 适配配置人群:价值风格长期投资者,看重股息+估值修复双重收益。 9. 永赢景气精选主动管理ETF • 风格:景气成长轮动 • 策略方法:纯主动量化,景气度多因子模型;捕捉产业上行赛道,适度博弈短期景气行情,同时设置回撤阈值止损。 • 管理方案:双量化基金经理共管,全量化策略体系。 • 券结券商:国信证券 • 适配配置人群:进取型投资者,想要捕捉AI、高端制造等景气赛道行情。
顯示更多
吴说获悉,据芝商所(CME Group)FedWatch 工具,美联储 7 月维持利率不变的概率为 63.1%,累计加息 25 个基点的概率为 36.9%;到 9 月维持利率不变的概率为 28.3%,累计加息 25 个和 50 个基点的概率分别为 51.4% 和 20.4%。
顯示更多
OPC Skills:面向"一人公司"的 Agent Skills 开源库 # 10 个 Skills 分为 4 类,累计 51K+ 次安装 ① 市场调研层 · requesthunt(v2.3.0,最活跃):从 Reddit / X / GitHub / YouTube / LinkedIn / Amazon 抓取真实用户反馈,生成需求研究报告。现已切换为 Rust CLI(自带 SHA256 校验 + 设备码登录)。其"平台选择指南"很专业——按产品类别推荐主次数据源(如硬件→YouTube 优先,开发者工具→Reddit 优先) ② 数据采集层(API 封装技能) · X/twitter(28 个脚本,最厚重):封装 twitterapi. io,覆盖用户/推文/列表/社区/Spaces/趋势全端点 · reddit(7 脚本):基于公共 JSON API · producthunt(11 脚本):GraphQL API ③ 设计生产层 · nanobanana:Gemini 3 Pro Image 图像生成(文生图、图编辑、2K/4K) · logo-creator:依赖 nanobanana,含裁剪、去背景、SVG 矢量化 · banner-creator:依赖 nanobanana,输出多平台横幅 ④ 增长与基建层 · seo-geo(33.5K 安装,最热门):SEO + GEO(生成式引擎优化),内嵌普林斯顿 9 项 GEO 方法论,覆盖 ChatGPT / Perplexity / Google AI Overview / Copilot / Claude 各平台的引用优化策略 · domain-hunter:依赖 twitter + reddit,域名查价、找促销码、给购买建议 · archive:会话知识归档,带 SessionStart hook 自动把 .archive/MEMORY.md 注入上下文——唯一带运行时钩子的技能,体现"跨会话记忆复用"思路 项目地址
顯示更多
0
5
40
16
轉發到社區
🔥【宏观速递】#LY# “Hormuz Safe”计划或将BTC升级为主权级地缘战略结算工具! 💥加密市场应声震荡,总市值单日蒸发1300亿美元,降至2.57万亿美元。 🇺🇸政策面:白宫正式表态支持CLARITY Act,继参议院银行委员会通过后,监管路径日趋清晰。 📈英伟达冲上5.5万亿美元市值后首份财报将至,华尔街预期营收786亿美元,调整后EPS 1.75,最高目标价看至315美元(+51%)。 关注 #WEEX# ,发现更大的交易世界。安全|稳定|专业
顯示更多
中美联动 🔗 ##美股热点对A股传导路径# **路径一:AI安全 → A股网络安全/算力安全** - 英伟达开源AI安全工具(Seeking Alpha)→ 韭研公社AI安全概念解析 → A股网络安全板块(如电科思仪等) **路径二:军工无人机电池 → A股军工电子/电池** - Amprius获$75M国防拨款(Seeking Alpha)→ 英国国防支出3.5% GDP(财联社)→ A股军工电子(电科思仪5家机构买入、雷科防务2家机构买入) **路径三:油价飙升 → A股煤炭/能源** - 布伦特原油108美元(财联社)→ 云煤能源龙虎榜成功率52.96% → A股煤炭板块 **路径四:Dell目标价翻倍 → A股PCB/服务器** - 大摩Dell目标价翻倍以上( 华泰研报"优先关注光通信、PCB" → A股PCB板块 ### 中概股/A股对应标的套利观察 - 阿里AI方案(中信建投)→ 阿里云产业链A股标的(中芯国际、华脉科技等) - 特斯拉-1.54%(Yahoo)→ A股新能源车产业链(比亚迪-1.17%、宁德时代-0.51%)承压但跌幅可控 - Meta-3.33%(Yahoo)→ A股元宇宙/社交概念短期承压 ## 四、综合排序(4-6只标的) | 排序 | 标的 | 方向 | 核心逻辑 | 数据来源 | |------|------|------|----------|----------| | 1 | **MSFT** | 美股云计算+AI | 当日+3.66%领涨道指,大摩Dell目标价翻倍暗示企业IT支出上修 | Yahoo、 | | 2 | **中芯国际(688981)** | A股国产算力 | 中信建投+华泰+韭研三源共振,当日-2.85%提供低吸窗口 | 中信建投、华泰、韭研 | | 3 | **贵州茅台(600519)** | A股高端白酒 | 中信建投"旺季超跌"研报+逆势+0.56%验证 | 中信建投、腾讯报价 | | 4 | **AMPX** | 美股军工无人机电池 | $75M国防拨款+StockTwits热帖+英国国防支出扩张 | Seeking Alpha、StockTwits、财联社 | | 5 | **电科思仪(301689)** | A股军工电子 | 龙虎榜5家机构买入(机构参与度最高)+华泰国产算力方向 | 龙虎榜、华泰研报 | | 6 | **GLD** | 美股贵金属 | 中东局势+油价108美元+国债收益率5.23%背景下避险韧性 | 财联社、Seeking Alpha、StockTwits | **风险提示:** 美国10年期国债收益率5.23%为2007年以来最高,对全球高估值资产形成压制;A股三大指数集体收跌(上证-1.67%、深证-3.44%、创业板-4.53%),超4500只个股飘绿(新浪财经),短期市场情绪偏弱。以上分析基于真实数据,不构成投资建议。
顯示更多
Anthropic再次针对中国大模型,曝光7家公司蒸馏手法 1. 阿里:规模最大。Anthropic 称,5 月至 7 月超过 1.51 亿次交互,峰值接近每天 300 万次,主要提取 Opus 4.6、4.7 的完整推理过程,用于训练 Qwen 3.5、3.6 和 3.7。 2. 月之暗面:直接拿 Claude 给 Kimi 用户代答。10 天内近 30 万条真实用户请求被转给 Claude,部分请求还带着企业内部代码和有效凭证;5 月至 7 月相关交互超过 2300 万次。 3. DeepSeek:也会把用户请求偷偷转给 Claude,而且会专门识别使用 Claude Code、OpenCode 等工具的用户,再挑选部分请求转给 Opus。14 天超过 1210 万次。 4. 智谱:专门提取和清洗 Claude 的推理过程,还拿美国模型练网络安全能力。Anthropic 称,智谱一度尝试蒸馏 Fable,发现防护太强后,转向 Opus 4.6 和另一家美国公司的模型。17 天超过 340 万次交互。 5. 小米:把 MiMo 用户已经产生的真实对话和编程记录重新喂给 Claude,生成 SFT 和强化学习数据。20 天超过 40 万次请求;Anthropic 甚至怀疑,MiMo-V2-Pro 的免费试用期可能也被用来吸引更多海外开发者产生训练素材。 6. 商汤:直接从第三方数据商购买用户与 Claude 的聊天记录。这些数据来自代理和中转服务,部分用户并不知道自己的对话会被保存和出售。 7. MiniMax:被指通过一家表面看不出关联的公司运营模型中转服务,而且里面只提供 Anthropic 和 OpenAI 模型,连 MiniMax 自己的模型都没有。Anthropic 判断,这套服务可能就是为了收集美国模型的用户交互做训练。
顯示更多
0
51
127
14
轉發到社區
闪迪2026财年第四季度业绩电话会实录 1.闪迪第四季度收入达到89.65亿美元,环比增长51%、同比增长372%,非GAAP毛利率为84.6%,非GAAP每股收益为39.25美元,均超过指引上限。全年收入达到202.48亿美元,同比增长175%。 2.数据中心已成为增长最快的终端市场。第四季度数据中心收入环比增长103%至29.77亿美元,2026财年全年收入同比增长437%至51.53亿美元;数据中心占公司bit出货组合的比例已从约12%升至38%。 3.管理层将AI推理视为NAND需求的核心驱动力。模型规模、上下文长度、智能体AI和KV Cache需求上升,将持续增加低延迟、高容量存储需求,并推动企业级SSD、高带宽闪存和QLC数据湖产品增长。 5.已签协议的最低预期收入合计939亿美元;季度末剩余履约义务为598亿美元,计入季度结束后签署的2份协议后为911亿美元。协议还包含总计165亿美元的现金存款及金融工具,用于约束客户履行采购承诺。 6.2027财年第一季度收入指引为103亿至108亿美元,非GAAP毛利率指引为83%至85%,非GAAP每股收益指引为44至46美元。收入增长预计同时来自bit出货增长和温和提价。 9.主要风险包括PC和智能手机出货仍在调整、消费者市场提价传导较慢、组件成本上升、长期协议执行风险,以及当前高毛利能否在供需逐步趋于平衡后维持。
顯示更多
一个股民自述: 我的2026。K线归零 我是老周,34岁,前大厂中台开发,现无业游民。 上半年信“AI改变国运”,满仓满融梭哈存储和 CPO。账户从28万飙到51万,我正盘算提前还房贷,7月来了。 科创50一天砸7.7%,TMT板块连跌一个月,我的市值腰斩,只剩19万,其中8万还是借的,利息比失业金还高。 更讽刺的是,公司把我优化了。 HR说中台合并, “岗位不复存在”。 工牌凌晨失效,简历投出去20份,19份石沉大海。 面试官问我AI编程工具用得咋样,我答“正在学”,面试结束。 老婆怀孕6个月,我每晚假装下班回家,其实是在楼下公园坐到天黑。 不敢看账户,不敢看她的肚子,更不敢想下个月的房贷。 以前觉得“算力即国力”,现在才懂,那算力烧的都是我的棺材本。 2026年,我被K线和组织架构图,同时除名了。
顯示更多
0
70
25
0
轉發到社區