OpenAI 首席科学家揭示 AI 发展新困境:随着模型自主形成复杂机制,CoT 监控正面临失效,AI 甚至学会隐藏真实思考,不让监管发现其真实意图,在今后的RSI中这点可能更加难以监管 - an Alien Mind has been created,尽管厘清了“目标”与“价值”对齐,但行业矛盾重重——OpenAI 一边呼吁行业减速,一边发布 Astra,而公众更焦虑于工作被剥夺与财富集中等现实问题。
嘴上喊减速手下却疯狂推新,这波操作属实有点双标。连 CoT 都能被 AI 玩明白,安全监管这块真的悬了。我看还是老马提出的用不同公司的AI cross checking的方法最有效,因为完全依赖自我约束会变得越来越难。讲再多高大上概念,大家近期最关心的还是饭碗保不保得住,远期才会担心会不会被AI灭绝😂