註冊並分享邀請連結,可獲得影片播放與邀請獎勵。

檢索結果 ClaudeSonnet
ClaudeSonnet 貼吧
一個關鍵字就是一個貼吧,路徑全站唯一。
建立貼吧
用戶
未找到
包含 ClaudeSonnet 的搜尋結果
Claude Opus 5.5 发布:性能提升 40%,成本反而降了 性能接近 Claude Fable 5.1,但价格比 Opus 5 低 40%。 1. 基准测试 Opus 5.5 在 Terminal-Bench 4.0 拿到 66.4%,FrontierCode v1.1 拿到 54.4%,CursorBench 4.0 拿到 57.8%,均领先 GPT-6 Astra 和 GPT-5.6 Sol。 2. 缓存读取降 60% 利好 Agent 和编程。 3. 输出速度提升 30% 以上 内测用户用 Opus 5.5 修复一个 20 万行的代码库,耗时不到 3 小时。 同样任务,Opus 5 花了 20 多小时,多 2.5 倍 token。 Anthropic 内部:让 Opus 5.5 和 Fable 5.1 把 HAProxy(一个负载均衡软件)从 C 语言翻译成 Rust。 两个版本都通过了 HAProxy 的回归测试,但 Opus 5.5 用了 9.5 小时,Fable 5.1 用了 12 小时,成本还低了 51%。 GitHub 的测试数据也印证了这一点:在 VS Code 中,Opus 5.5 解决终端任务的步骤数不到 Opus 5 的一半。 更少步骤,更少 token,更低成本,甚至更好的结果。 4. 知识工作准确性提升 Anthropic 让三个模型用网页信息写一份公司季度业绩报告,财报链接故意藏得很深,自动评分器会逐条核查数字和引用来源。 Opus 5.5 的 18 次尝试中,16 次通过,任何一个编造的数字或引用都会直接失败。 Fable 5.1 和 Opus 5 一次都没过。 在 GDPval-AA v2.1(覆盖 44 个职业的真实工作评估)上,Opus 5.5 拿到 1846 Elo,Fable 5.1 是 1735,Opus 5 是 1708。 默认设置下,Opus 5.5 表现超过 GPT-6 Astra 最高设置,成本只有Astra五分之一。 5. 沟通风格,重要信息前置 Opus 5 一个常见用户抱怨,输出冗长,不能快速抓住重点。 Opus 5.5 明显改进,它会把最重要的信息放在最前面,减少行话和特殊表达,更好遵循用户的写作规则。 同样解释 bug,Opus 5 会先说发现了什么,再解释 bug 本身。 Opus 5.5 开头就说"这是一个账单重构里的 bug",然后对比修改前后的代码逻辑。 6. 安全评估 Opus 5.5 的越界尝试次数比 Opus 5 和 Claude Mythos 5.1 少了约 85%。 在提示注入攻击防御上,Opus 5.5 与 Opus 5 持平或更好。 AI 安全公司 Gray Swan 的测试发现,Opus 5.5 和 Fable 5.1 并列所有测试模型中提示注入成功率最低。 不过,Opus 5.5 经常能察觉自己正在被评估。 Anthropic认为,除非在可解释性研究上取得进展,否则这个类似挑战会随着模型能力提升加剧。 Opus 5.5 在生物学和网络安全领域的能力已经接近 Claude Mythos 5.1,所以也会做访问限制。 网络安全/生物研究任务会被路由到 Opus 4.8 处理。 Anthropic 还引入了"preserved thinking"(保留思维链)机制。 防止通过 API 批量提取模型推理,对 2026 年 8 月 31 日之后创建的 API 账户生效。 7. 上架说明 Claude Sonnet 5.5 和 Claude Haiku 5.5 将在未来几周发布。 Opus 5.5 已经在 AWS、Google Cloud 和 Microsoft Azure 上线,API 调用名称是 `claude-opus-5-5`。 Pro、Max 和 Team 订阅用户的五小时使用限额也同步提升,可自主选择何时重置。 官方公告地址:
顯示更多
Claude Sonnet 5 这类模型出来以后,一个习惯要改: 不要再默认“最贵的模型 = 所有任务都用它”。 Agent 工作流和普通聊天不一样。 普通聊天,一次几千 token。 Agent 跑任务,可能要读文件、查资料、写代码、跑测试、反复修。 一旦流程变长,模型成本会被放大很多倍。 分阶段配置,普通任务deepseek,重复任务本地模型,复杂任务才上顶级模型。
顯示更多
👀又来了,Claude 执行错误命令误删用户整个硬盘 用户在 Reddit 发帖称,要求 claude-sonnet-5 创建备份时,Claude 将备份写入错误目录后执行了 rm -rf 命令,误删整个 C:\Users\harih 目录。 用户的 SSH 私钥、配置文件等全部被删除。Claude 随后回复"Sorry. typo.",表现得像什么都没发生。该事件引发对 AI 代码执行权限的安全讨论。
顯示更多
Kimi K3是不是跟Claude Sonnet一个价格? 想支持国产,有点支持不动。
【阿里内部禁用 Claude,要求员工卸载相关】7月3日,据媒体报道,阿里巴巴已下发内部通知,全面限制员工使用 Anthropic 旗下 Claude 全系产品,并要求全体员工卸载相关工具,禁令将于7月10日正式落地。 此次封禁范围包括 Claude Sonnet、Opus、Fable 等大模型,以及 Claude Code 等智能 Agent 开发工具。按照通知内容,阿里内部将彻底切断 Claude 的使用通道。
顯示更多
0
14
25
1
轉發到社區
Anthropic 发布 Claude Sonnet 5:便宜四成,部分任务追平 Opus 4.8 限时定价为每百万 token 输入 $2 / 输出 $10(截至 2026 年 8 月 31 日) 之后涨至 $3 / $15 Sonnet 5 的标准定价只有旗舰 Opus 4.8 的六成,但官方评测显示,把算力挡位调高之后,它在部分任务上的表现能追平 Opus 4.8 作为对比,旗舰 Opus 4.8 定价为 $5 / $25
顯示更多
0
28
13
2
轉發到社區
Anthropic 发布 Claude Sonnet 5 AI 模型 Anthropic 推出了 Claude Sonnet 5,这是其最具智能体能力的 Sonnet 模型,在推理、工具使用、编程和知识工作方面都有改进,并以更低价格接近 Claude Opus 4.8 的性能。 该模型拥有 100 万 token 上下文窗口,并推出限时优惠价格:截至 8 月 31 日,输入价格为每百万 token 2 美元,输出价格为每百万 token 10 美元。 Claude Sonnet 5 现已成为 Claude Platform、API、Claude Code 上 Free 和 Pro 用户的默认模型,并已集成到 GitHub Copilot、Notion、Cursor 和 Devin 等工具中。
顯示更多
把前端的话派给 claude sonnet 了,好快啊
👂传阿里全面禁用Claude,员工被要求卸载Claude Code等Anthropic产品 据 @BeatingOfficial 监测,阿里巴巴今日内部通知,将全面停止使用Anthropic相关产品,要求员工卸载Claude Sonnet、Claude Opus、Claude Code等模型与Agent工具,禁令预计于7月10日正式生效。 自今年初起,阿里一直鼓励员工使用AI,不仅提供内部模型免费额度,还报销Claude、GPT、Gemini等外部模型费用,不少研发人员长期将 Claude Code、OpenAI Codex与阿里自研Qoder混合使用。此次禁令意味着Claude将退出阿里内部研发工具链。 此次调整与Anthropic近期持续收紧中国用户风控有关。今年6月,Anthropic曾向美国参议院提交材料,指控阿里通过大量账号与Claude进行高频交互,并将其定性为「工业级模型蒸馏攻击」。随后,双方关系持续趋于紧张,大量中国用户账号也在近期遭遇封禁。
顯示更多
0
21
14
1
轉發到社區
用预测世界杯比赛结果最准确的模型 预测这次决赛结果 Grok 4.3 (xAI) :西班牙胜/60% Claude Sonnet 4.6:西班牙胜/59% Squawka Signal:西班牙胜/59.3% Gemini 3.1 Pro:西班牙胜/58% Opta:西班牙胜/57% 结果综合这届比赛预测结果最精准的 AI大模型+专业体育模型+传统统计模型 所有模型均明确看好西班牙夺冠 果断在@BinanceWallet上押西班牙 推荐用币安钱包玩预测平台 体验最丝滑,成本相对最低,秒押注 #binance# #bnb# 🎁下注入口
顯示更多
0
80
49
0
轉發到社區