白宫准备修改刚刚确定的 AI 安全审查规则,把能力足够强的开源模型也纳入发布前测试。《WIRED》称,只要模型达到 Anthropic Mythos 或 OpenAI GPT-5.6 这一档能力,就可能适用这套规则。
目前这套机制仍是自愿参加。达到门槛的模型,可以在正式提供给外部合作方前,提前最多 30 天交给美国政府测试网络攻击能力。白宫没有公开具体测试标准。
变化来得很快。上周白宫刚决定,开放权重模型暂时不需要接受这套审查,重点检查 OpenAI、Anthropic 等公司的闭源前沿模型。现在白宫又准备把开源模型加回来。
原因之一是政府担心两套规则反而会伤害美国开源模型。闭源模型通过政府测试后,可以获得一层安全背书;开源模型如果完全不测,企业客户反而可能更不敢用。
目前新规则还没有正式落地,《WIRED》称白宫预计会在未来几个月继续推进。
顯示更多
Open models may soon be added to an updated AI framework, sources tell WIRED, as the White House continues to grapple with how to regulate a technology it has tried not to regulate.
顯示更多