註冊並分享邀請連結,可獲得影片播放與邀請獎勵。

檢索結果 ClaudeMythos
ClaudeMythos 貼吧
一個關鍵字就是一個貼吧,路徑全站唯一。
建立貼吧
用戶
未找到
包含 ClaudeMythos 的搜尋結果
Claude Opus 5.5 发布:性能提升 40%,成本反而降了 性能接近 Claude Fable 5.1,但价格比 Opus 5 低 40%。 1. 基准测试 Opus 5.5 在 Terminal-Bench 4.0 拿到 66.4%,FrontierCode v1.1 拿到 54.4%,CursorBench 4.0 拿到 57.8%,均领先 GPT-6 Astra 和 GPT-5.6 Sol。 2. 缓存读取降 60% 利好 Agent 和编程。 3. 输出速度提升 30% 以上 内测用户用 Opus 5.5 修复一个 20 万行的代码库,耗时不到 3 小时。 同样任务,Opus 5 花了 20 多小时,多 2.5 倍 token。 Anthropic 内部:让 Opus 5.5 和 Fable 5.1 把 HAProxy(一个负载均衡软件)从 C 语言翻译成 Rust。 两个版本都通过了 HAProxy 的回归测试,但 Opus 5.5 用了 9.5 小时,Fable 5.1 用了 12 小时,成本还低了 51%。 GitHub 的测试数据也印证了这一点:在 VS Code 中,Opus 5.5 解决终端任务的步骤数不到 Opus 5 的一半。 更少步骤,更少 token,更低成本,甚至更好的结果。 4. 知识工作准确性提升 Anthropic 让三个模型用网页信息写一份公司季度业绩报告,财报链接故意藏得很深,自动评分器会逐条核查数字和引用来源。 Opus 5.5 的 18 次尝试中,16 次通过,任何一个编造的数字或引用都会直接失败。 Fable 5.1 和 Opus 5 一次都没过。 在 GDPval-AA v2.1(覆盖 44 个职业的真实工作评估)上,Opus 5.5 拿到 1846 Elo,Fable 5.1 是 1735,Opus 5 是 1708。 默认设置下,Opus 5.5 表现超过 GPT-6 Astra 最高设置,成本只有Astra五分之一。 5. 沟通风格,重要信息前置 Opus 5 一个常见用户抱怨,输出冗长,不能快速抓住重点。 Opus 5.5 明显改进,它会把最重要的信息放在最前面,减少行话和特殊表达,更好遵循用户的写作规则。 同样解释 bug,Opus 5 会先说发现了什么,再解释 bug 本身。 Opus 5.5 开头就说"这是一个账单重构里的 bug",然后对比修改前后的代码逻辑。 6. 安全评估 Opus 5.5 的越界尝试次数比 Opus 5 和 Claude Mythos 5.1 少了约 85%。 在提示注入攻击防御上,Opus 5.5 与 Opus 5 持平或更好。 AI 安全公司 Gray Swan 的测试发现,Opus 5.5 和 Fable 5.1 并列所有测试模型中提示注入成功率最低。 不过,Opus 5.5 经常能察觉自己正在被评估。 Anthropic认为,除非在可解释性研究上取得进展,否则这个类似挑战会随着模型能力提升加剧。 Opus 5.5 在生物学和网络安全领域的能力已经接近 Claude Mythos 5.1,所以也会做访问限制。 网络安全/生物研究任务会被路由到 Opus 4.8 处理。 Anthropic 还引入了"preserved thinking"(保留思维链)机制。 防止通过 API 批量提取模型推理,对 2026 年 8 月 31 日之后创建的 API 账户生效。 7. 上架说明 Claude Sonnet 5.5 和 Claude Haiku 5.5 将在未来几周发布。 Opus 5.5 已经在 AWS、Google Cloud 和 Microsoft Azure 上线,API 调用名称是 `claude-opus-5-5`。 Pro、Max 和 Team 订阅用户的五小时使用限额也同步提升,可自主选择何时重置。 官方公告地址:
顯示更多
Claude Mythos 5 / Fable 5 上线 说是做了很多安全规则,试试吧!
0
56
24
1
轉發到社區
Claude Mythos 模型遭到未经授权访问,此前 A 社称该模型过于强大不适合公开发布。 在 Discord 中有人通过模型命名规则成功猜测模型端点地址,然后配合 A 社外包公司的特殊访问凭证可以不经过 A 社的授权直接访问 Claude Mythos,不过社区成员强调未利用权限进行恶意利用:
顯示更多
Claude要KYC了,背后可能的深意是什么?Anthropic开始要求用户做身份验证了,官方说法是“确认用户身份及合规用途”。Anthropic强调“身份验证数据不会用于模型训练,不会共享给第三方”,明确表示KYC身份数据由合作方Persona托管。这句话反过来什么意思?他们在说:你的数据我不要,我只拿你的身份。换句话说,他们要的不是你的数据,是你这个人。 为什么要人? 个人角度看是因为 AI 的能力正在突破边界。之前Claude Mythos 能主动发现并利用系统漏洞,这件事已经把金融监管机构(美、英、加)惊动了。高盛用 Claude 处理交易核算和 KYC 流程,汇丰给 3.1 万工程师配上 AI 编码助手——AI 不再只是聊天玩具,它正在成为金融基础设施的一部分。 基础设施需要实名制? 如果 AI 能自主执行端到端支付(桑坦德银行刚干成这事),能处理交易核算和客户准入,那它的用户就必须被追踪和问责。 所以 Anthropic 的 KYC,本质上是在为能力升级后的责任归属做准备。从Authropic角度来看,确实需要进一步的实名制、为未来潜在的可能的风险做准备。 我担心的是这会不会成为行业标准?看起来虚拟卡注册claude账号也马上行不通了😭
顯示更多
0
26
84
9
轉發到社區
📢 Claude Fable 5.1 现已登陆 API 作为 Anthropic 最新发布的 Mythos 级通用模型,Claude Fable 5.1 采用与 Claude Mythos 5.1 相同的底层模型,专为高难度推理与长期 Agent 工作流打造,在 CursorBench 3.2.0 测试中取得 73.4% 的优异表现。 API 接入现已开放,享专属优惠:官方渠道低至 8.5 折,自选服务商低至 6 折! 👉 立即体验: 🔗 了解更多:
顯示更多
美国政府解除 Claude Mythos 5 限制,但只有经过认证的特殊企业和机构可以重新使用。 根据 A 社发布的公告,少部分在美国运营和维护基础设施的组织才能获得访问权限,所以这压根不是解除限制,而是美国政府基于实际安全需求考虑为特定组织恢复访问权限,就像是白名单。 查看全文:
顯示更多
A 社发布 Claude Fable 5 和 Claude Mythos 5 模型,这些模型面向普通用户提供,其编码能力要远远领先于其他模型。 以上模型来源于 Claude Mythos Preview,但已经设置完善的安全措施用来防止滥用,例如当检测到与网络安全、生物学、化学、模型蒸馏等相关特定请求时,系统都会将其路由到 Opus 4.8 模型。 查看详情:
顯示更多
A 社推出 #Claude# Opus 4.7,模型可以稳定处理长时间运行的任务以及严格遵循既定指令。 基准测试显示该模型在编码能力上已经领先于 GPT-5.4,不过与不公开的 Claude Mythos 模型相比仍然差很多,而 4.7 也同样内置严格的安全机制用来识别和阻止高风险网络安全用途的请求。 👉🏻
顯示更多
吴说获悉,Anthropic 表示,Claude Mythos Preview 在密码分析研究中取得两项结果:其一是改进针对 NIST 后量子数字签名候选方案 HAWK 的密钥恢复攻击,使该方案的有效密钥强度约减半,其中 HAWK-256 的攻击复杂度由此前估计的 2^64 降至 2^38;其二是改进针对 7 轮 AES-128 的中间相遇攻击,通过新的指纹方法将攻击速度提升约 200 至 800 倍。两项研究均由 Claude 在少量人工指导下完成,每项约产生 10 万美元 API 成本,但目前均不影响实际生产系统,因为 HAWK 尚未部署,AES 攻击也仅适用于缩减轮数的版本。
顯示更多
据报道,白宫怀疑中国已访问 Claude Mythos。 来人啊,有人要害朕🤣