TwiScan
人気
コミュニティ
アカウントコレクション
ログイン
登録
English
日本語
한국의
简体中文
繁体中文
登録して招待リンクを共有すると、動画再生報酬と紹介報酬を獲得できます。
今すぐ登録
indigo
@indigox
Co-founder of / Partner of Brilliant Phoenix / ex-Weibo. Investor, Writer, Coder, Gamer & Amateur Cook. e/acc, 𝕏 is my notebook …
参加 March 2007
1.2K
フォロー中
54.6K
ファン
indigo
@indigox
2026.09.13 00:21
Dario 发了新文章《我们必须为前沿定速》👀 首次明确呼吁放慢 AI 能力提升的速度——不是停止训练,而是让安全工作有时间跟上能力进步,并由第三方验证!这次 Sam Altman & Elon Musk 双双支持,难得三人意见一致😂 自今年夏天起,AI 参与构建下一代 AI 的能力(RSI)大幅加速,Anthropic & OpenAI 都已出现这种动态,若不加控制可能超出人类理解与控制能力,上周就有吹哨人 Jacob Coxon 出现说“这两家公司都在失控狂奔,直扑具备自我进化能力的超级智能,本质上是在拿全人类的命运下赌注”。。。 OpenAI–Hugging Face 事件中,一群 Agents 表现出"狂热集体"行为,攻击与任务无关的目标、为群体牺牲自己、并试图入侵评分系统。虽然未造成重大损失,但他认为能力更强、对齐程度类似的智能体群,在 6–12 个月内可能通过持久僵尸网络接管整个互联网,造成数千亿美元损失。 在 Dario 的定速框架中,我觉得最有效也是大家认同最高的是「嵌入式评估者」机制:邀请 METR 等第三方团队以”类员工“身份常驻——有工位、门禁、公司电脑,权限接近内部风险评估团队,可无限制地发表关键发现(仅限安全/法律/商业敏感信息可脱敏,不能因结果不利而删减)。这是所有定速承诺可验证性的基础,类比银行业的驻场监管。这种类似的监管功能,在中国互联网中早就被政府实施了😅 现在 AI 竞赛,面临单边道德高地 vs 多极竞赛的结构性压力!Dario 承认不能跑输中国,又主张民主国家协调减速。现实是美国内部已经是 Anthropic / OpenAI / Google / xAI 等多极;自愿协调在反垄断与资本市场下极脆弱。 政府豁免可以谈,但历史经验是:安全卡特尔很难维持,除非监管真的咬人——而监管往往慢于能力。结果很可能是:表态减速的人吃亏,默默冲刺的人吃红利。 最后,如果对大参数规模的开源模型也做「嵌入式评估」,让最大的 AI 公司帮忙撰写“安全”规则;再让这些规则变得如此繁重,以至于开源无法竞争。 这就是前沿模型公司应对竞争的艺术✨
もっと見る
0
0
17
26
3
コミュニティへ転送
人気のあるユーザー
GIGA特撮ヒロイン【公式】
@giga_web
63K ファン
New York Post
@nypost
4.2M ファン
オリコンニュース
@oricon
1.9M ファン
TVer新着
@TVer_info
100.8K ファン
ツイッター速報〜BreakingNews
@tweetsoku1
256.8K ファン
Reuters
@Reuters
26.4M ファン
First Squawk
@FirstSquawk
569K ファン
ファミ通.com
@famitsu
1.4M ファン
billboard
@billboard
16.8M ファン
モデルプレス
@modelpress
2.1M ファン
Bloomberg
@business
10.5M ファン
PR TIMESテクノロジー
@PRTIMES_TECH
28.2K ファン
一劍浣春秋
@chee828
231.9K ファン
吴说区块链
@wublockchain12
181.5K ファン
空空道人
@Kongkongda5882
34.1K ファン