OpenAI 没有把新模型 Astra 整体叫停,而是暂停了不符合更严格安全条件的内部开发活动,把相关工作转进限制联网的隔离环境。
原因也不是已经确认 Astra 发动过攻击。
OpenAI 的初步评估只能说明:它暂时无法排除该模型达到“关键”网络能力门槛,例如自行发现并利用严重的真实漏洞,或对高安全目标执行复杂攻击。
翻译成工程现场,就是模型越会写代码、找漏洞,开发它的人反而越不能随手联网测试。隔离环境、权限控制和额外评估都会拉长迭代,也把更多工作从训练模型转到看守模型。
这类能力同时能帮企业找漏洞,也能降低攻击门槛。厂商想继续卖更强的模型,就得先承担隔离、审计和延迟发布的成本,不能把防守和善后全留给下游客户。
顯示更多