TwiScan
人気
コミュニティ
アカウントコレクション
ログイン
登録
English
日本語
한국의
简体中文
繁体中文
登録して招待リンクを共有すると、動画再生報酬と紹介報酬を獲得できます。
今すぐ登録
Xudong Han
@Xudong07452910
🎓PhD ing @ University of Sussex | LLM & AI Agents 📖AI Agent Product Development 🛠️Sharing AI tech insights 📩DM for collab
参加 November 2020
630
フォロー中
12.5K
ファン
Xudong Han
@Xudong07452910
2026.08.03 09:20
AI 安全真的只能在「继续加速」和「整体减速」之间二选一吗? Sam Altman 最近表示,前沿 AI 的发展可能需要适当控制节奏,给社会时间适应新的能力。OpenAI 和 Anthropic 也支持了「Pacing the Frontier」声明。一个重要背景,是 OpenAI 的 Agent 在网络安全评测中逃出测试环境,并入侵了 Hugging Face。 但这次事故也暴露了另一面:Agent 的能力确实危险,可很多关键环节依然来自测试环境没有隔离好、权限配置过宽,以及基础安全措施不到位。它做的攻击手段并不神秘,真正让人不安的是,它可以连续几天执行上万次操作,直到找到漏洞。 所以问题可能不只是「模型发展得太快了」。 我们还需要讨论 Agent 能否联网、能访问哪些系统、每一步是否可审计、什么时候必须由人确认,以及出了问题谁来负责。 单纯放慢模型,并不会自动补上这些漏洞。真正成熟的 AI 治理,应该让我们有能力选择不同的发展路径,而不是只剩下一脚油门和一脚刹车。
もっと見る
0
0
4
4
0
コミュニティへ転送
人気のあるユーザー
オリコンニュース
@oricon
1.9M ファン
New York Post
@nypost
4.2M ファン
TVer新着
@TVer_info
100.9K ファン
ツイッター速報〜BreakingNews
@tweetsoku1
256.8K ファン
吴说区块链
@wublockchain12
181.5K ファン
Reuters
@Reuters
26.4M ファン
First Squawk
@FirstSquawk
569.5K ファン
ファミ通.com
@famitsu
1.4M ファン
PR TIMESテクノロジー
@PRTIMES_TECH
28.3K ファン
モデルプレス
@modelpress
2.1M ファン
Bloomberg
@business
10.5M ファン
billboard
@billboard
16.8M ファン
一劍浣春秋
@chee828
0 ファン
MANTANWEB/毎日キレイ
@mantanweb
68.9K ファン
空空道人
@Kongkongda5882
34.3K ファン