TwiScan
人気
コミュニティ
アカウントコレクション
ログイン
登録
English
日本語
한국의
简体中文
繁体中文
登録して招待リンクを共有すると、動画再生報酬と紹介報酬を獲得できます。
今すぐ登録
Xudong Han
@Xudong07452910
🎓PhD ing @ University of Sussex | LLM & AI Agents 📖AI Agent Product Development 🛠️Sharing AI tech insights 📩DM for collab
参加 November 2020
600
フォロー中
11.4K
ファン
Xudong Han
@Xudong07452910
2026.08.16 06:20
最近用 Opus 5 写代码,我也一直被一个问题困扰: 模型明明更强了,但有时候反而更难一起工作。 刚好看到一篇文章也在聊这个。作者发现 Opus 5 遇到模糊需求时,更容易自己做假设,然后一路往下执行,甚至会悄悄扩大任务范围、重新解释原来的计划。 以前 Opus 4.8 或 Fable 有些时候会停下来问一句:「你这里到底想要 A 还是 B?」 Opus 5 更喜欢自己选一个,然后继续干。 更有意思的是,Anthropic 自己的 Opus 5 Prompting Guide 也专门提醒了这个问题:它可能主动扩大 scope、加入没要求的步骤,所以窄任务需要明确告诉它不要擅自扩展。 文章里给了一个挺有意思的猜测: Benchmark 和 RLVR 更容易奖励「大胆做出假设然后把任务完成」的模型。但真实的软件工程里,很多信息永远写不完整。业务背景、隐含约束、架构取舍,经常没有唯一正确答案。 Agent 更自主当然很好,但如果每次都要盯着它别跑偏,这种 autonomy 的价值就要重新算了。 原文:
もっと見る
0
0
6
24
3
コミュニティへ転送
人気のあるユーザー
オリコンニュース
@oricon
1.9M ファン
TVer新着
@TVer_info
100K ファン
ツイッター速報〜BreakingNews
@tweetsoku1
256.9K ファン
New York Post
@nypost
4.1M ファン
一劍浣春秋
@chee828
230.9K ファン
モデルプレス
@modelpress
2M ファン
AKB48公式
@AKB48_staff
289.5K ファン
ファミ通.com
@famitsu
1.4M ファン
NMB48 Official
@nmb48_official
133.7K ファン
空空道人
@Kongkongda5882
30.6K ファン
フレッシュ撮影会【公式】
@fresh_akiba
94.3K ファン
HKT48
@hkt48_official_
150.8K ファン
中國新聞社
@CNS1952
547.1K ファン
乃木坂46
@nogizaka46
2M ファン
STU48
@STU48_official_
103.9K ファン