註冊並分享邀請連結,可獲得影片播放與邀請獎勵。

檢索結果 551蓬莱〉の
551蓬莱〉の 貼吧
一個關鍵字就是一個貼吧,路徑全站唯一。
建立貼吧
用戶
未找到
包含 551蓬莱〉の 的搜尋結果
🌸 5.1-5.5 #币安# 春日假期出游季,一起来官方社区聊天室晒假期照片吧! 打开 App 右上角【聊天】-【推荐群】,加入名称后带有「官方」标记的社区聊天室,分享你的出游美照📸 活动期间,分享图片最多、互动最活跃的 5 个群,将各获得 5份限量周边奖励🎁 快来一起晒春日、聊假期~
顯示更多
Sonnet 5.5 发布了,这个模型很神奇:它在 Agentic coding 测试上的得分比 Opus 5.5 还要高 4 分。 定价上也非常便宜,每百万 token 输入输出的价格分别是 $2 和 $10,与 GPT-6 Sol 一样。而且它的运行速度相对于 Sonnet 5 快了 30%,Claude 官方表示成本也降低了 30%。 至于为什么它在 Agentic coding 上的表现跟 Opus 5.5 差不多甚至更高,可以看一下价格测试。 Sonnet 5.5 在 max 努力程度下,同样任务的花费金额比 Opus 5.5 还要高得多,快要持平甚至反超了,这可能就是它得分高的原因。 所以大家在用 Opus 5.5 或者 Sonnet 5.5 的时候千万别开 max:在一些复杂任务上,它有可能跑出非常贵的价格,几乎赶上 Claude Fable 5.1 了
顯示更多
0
12
35
2
轉發到社區
Opus 5.5 这次真有点把我整不会了。 前两个月 Opus 5 写代码还经常让我血压上来,话多、乱扩 scope,小改动也能给你整成大工程,并且说黑话难懂。 结果今天拿 5.5 跑了半天,体感直接变了,现在是更听话、更克制,长任务也稳了很多,也能输出人话了😂。 看一些我比较在意的 benchmark 分数都涨了不少,虽然我现在不太 care 这个了。 我现在感觉开发主力都可以从 Fable 5.1 换到 Opus 5.5 了,Fable 5.1 还是太吃 token。 才两个月,这次模型的进步真是实打实的。
顯示更多
0
26
71
2
轉發到社區
Claude Opus 5.5 发布:性能提升 40%,成本反而降了 性能接近 Claude Fable 5.1,但价格比 Opus 5 低 40%。 1. 基准测试 Opus 5.5 在 Terminal-Bench 4.0 拿到 66.4%,FrontierCode v1.1 拿到 54.4%,CursorBench 4.0 拿到 57.8%,均领先 GPT-6 Astra 和 GPT-5.6 Sol。 2. 缓存读取降 60% 利好 Agent 和编程。 3. 输出速度提升 30% 以上 内测用户用 Opus 5.5 修复一个 20 万行的代码库,耗时不到 3 小时。 同样任务,Opus 5 花了 20 多小时,多 2.5 倍 token。 Anthropic 内部:让 Opus 5.5 和 Fable 5.1 把 HAProxy(一个负载均衡软件)从 C 语言翻译成 Rust。 两个版本都通过了 HAProxy 的回归测试,但 Opus 5.5 用了 9.5 小时,Fable 5.1 用了 12 小时,成本还低了 51%。 GitHub 的测试数据也印证了这一点:在 VS Code 中,Opus 5.5 解决终端任务的步骤数不到 Opus 5 的一半。 更少步骤,更少 token,更低成本,甚至更好的结果。 4. 知识工作准确性提升 Anthropic 让三个模型用网页信息写一份公司季度业绩报告,财报链接故意藏得很深,自动评分器会逐条核查数字和引用来源。 Opus 5.5 的 18 次尝试中,16 次通过,任何一个编造的数字或引用都会直接失败。 Fable 5.1 和 Opus 5 一次都没过。 在 GDPval-AA v2.1(覆盖 44 个职业的真实工作评估)上,Opus 5.5 拿到 1846 Elo,Fable 5.1 是 1735,Opus 5 是 1708。 默认设置下,Opus 5.5 表现超过 GPT-6 Astra 最高设置,成本只有Astra五分之一。 5. 沟通风格,重要信息前置 Opus 5 一个常见用户抱怨,输出冗长,不能快速抓住重点。 Opus 5.5 明显改进,它会把最重要的信息放在最前面,减少行话和特殊表达,更好遵循用户的写作规则。 同样解释 bug,Opus 5 会先说发现了什么,再解释 bug 本身。 Opus 5.5 开头就说"这是一个账单重构里的 bug",然后对比修改前后的代码逻辑。 6. 安全评估 Opus 5.5 的越界尝试次数比 Opus 5 和 Claude Mythos 5.1 少了约 85%。 在提示注入攻击防御上,Opus 5.5 与 Opus 5 持平或更好。 AI 安全公司 Gray Swan 的测试发现,Opus 5.5 和 Fable 5.1 并列所有测试模型中提示注入成功率最低。 不过,Opus 5.5 经常能察觉自己正在被评估。 Anthropic认为,除非在可解释性研究上取得进展,否则这个类似挑战会随着模型能力提升加剧。 Opus 5.5 在生物学和网络安全领域的能力已经接近 Claude Mythos 5.1,所以也会做访问限制。 网络安全/生物研究任务会被路由到 Opus 4.8 处理。 Anthropic 还引入了"preserved thinking"(保留思维链)机制。 防止通过 API 批量提取模型推理,对 2026 年 8 月 31 日之后创建的 API 账户生效。 7. 上架说明 Claude Sonnet 5.5 和 Claude Haiku 5.5 将在未来几周发布。 Opus 5.5 已经在 AWS、Google Cloud 和 Microsoft Azure 上线,API 调用名称是 `claude-opus-5-5`。 Pro、Max 和 Team 订阅用户的五小时使用限额也同步提升,可自主选择何时重置。 官方公告地址:
顯示更多
【5月22日 8点整 NBA 纽约尼克斯 vs 克利夫兰骑士】 (本场赛事红包雨🧧求互动@出美少女大赛) 数据初盘开出全场让分:纽约尼克斯-5.5,机构倾向主队优势。NBA东部决赛,主队已斩获八连胜,关键球把握能力极强,球队攻防兼备,韧性十足,气势如虹。客队系列赛首场加时赛104-115不敌对手,球队体能消耗较大,比赛尾段状态欠佳,整体表现未如理想。两队本赛季四次交锋纽约尼克斯3胜1负占优,整体实力略胜一筹,另加主场之利,综合分析本场看好主队继续连胜节奏。 主队总分:大110@1.86 全场让分:纽约尼克斯-5.5@1.85 全场大小:大214.5@1.93
顯示更多
0
4
4
202
轉發到社區
#AI# Sonnet 5.5 还是不太行,debug 给的方案复杂,感觉不对。 让它交给 Fable 5.1 去研究,几分钟跑了 week 额度的 5%,给出结论是 —— 只用改一行。 还是贵的好啊。
顯示更多
【开云-8月5日 17点整 LPL 北京JDG vs LGD】 数据初盘开出全局获胜:北京JDG@1.365/LGD@3.176,机构倾向JDG优势明显。LPL中国职业联赛第三赛段登峰组,JDG暂以1胜4负排名登峰组第6位,净胜场-3,近期整体状态低迷,但上一场面对强敌BLG虽有失利,队伍在部分对局中仍展现出一定韧性,整体硬实力与运营底蕴仍不容低估。LGD同样以1胜4负排名登峰组第5位,净胜场-4,战绩与JDG持平,但队伍打法极度依赖野区节奏,面对中上游队伍时稳定性不足,整体表现欠缺持续性。两队近四次交手JDG取得全胜,近年交锋占据压倒性优势,综合分析本场看好JDG拿下LGD止住颓势。 首局击杀让分:北京JDG-5.5@1.722 首局击杀总数:大29.5@1.800 首局比赛时间:大31@1.767
顯示更多
📢 Claude Opus 5.5 现已登陆 作为 @AnthropicAI 最新发布的 Claude 5.5 系列首款模型,Claude Opus 5.5 专为长周期 Agent 编程与复杂知识工作打造。其多数任务性能达到 Claude Fable 5.1 水平,同时运行成本比 Opus 5 降低约 40%。模型支持 1M Token 超长上下文与最高 128K 输出,并在 Computer Use 与多步骤自动化场景展现出领先能力。 API 与 Web Chat 双端同步开放,欢迎体验! 👉 体验入口: 🔗 了解更多:
顯示更多
不知道那些KOL怎么写出来“GLM-5/5.1 综合能力对标Claude Opus 4.6” 只要自己下场用过GLM-5/5.1,无论是plan还是长任务真的不行。
0
53
27
0
轉發到社區
白🐯萝莉,天然真c无整 🪂成都短期5.5之前都在,➕1k全国✈️ 蹲爸爸,哥哥,金主入🚪 高颜反差幼态萝莉🥰乖巧听话,5.1世界线🉑约 @ToBulaer @KawasawaSen @BulmaList @ToBuerma
顯示更多
0
0
257
16
轉發到社區