AI 安全的黑箱:OpenAI 的 Sol 是如何获得批准的
随着 OpenAI 推出其最新的前沿模型 Sol,一个关键问题正困扰着整个科技行业:政府究竟是如何判定该模型可以安全地向公众发布?虽然 Sol 旨在与 Anthropic 的 Fable(此前曾受到白宫限制的模型)展开竞争,但审批过程缺乏透明度,这正在监管机构和研究人员之间引发激烈辩论。
缺乏标准化的安全协议
尽管部署前沿模型的风险极高,但目前仍缺乏统一、透明的 AI 安全认证框架。虽然 OpenAI 首席执行官 Sam Altman 证实,公司已与包括商务部长 Howard Lutnick 和美国国家网络总监 Sean Cairncross 在内的高级官员进行了沟通,但用于验证 Sol 的具体技术基准仍不为人知。
专家将当前的监管格局描述为“临时性”的。虽然最近的一项行政命令为评估前沿模型制定了路线图,但具体细节仍在完善中。至关重要的是,目前还没有“AI 领域的 FDA”,前白宫 AI 顾问 Sriram Krishnan 也表达了同样的观点。由于缺乏中央监管机构,目前的安全性评估主要依赖于公司内部流程和自愿性外部审计的拼凑组合。
创新与监管之间的紧张关系
Anthropic 的 Fable 的发布凸显了这种缺乏监管环境的不稳定性。由于担心其“越狱”能力可能助长黑客攻击,Fable 曾一度禁止外国公民访问。相比之下,OpenAI 的 Sol 在为部分政府用户进行了模型预览后,已转向大规模发布。
这种差异引发了人们对政治关系影响力的质疑。有关 OpenAI 领导层与政府接触的报道,使得一些观察家开始怀疑是否正在实施一种“轻触式”(lighter-touch)的监管方式。对于开发者和创始人来说,这创造了一个不稳定的环境,模型部署可能更多地取决于政治博弈,而非标准化的技术安全指标。
向第三方审计和开放公地迈进
行业领袖们正呼吁进行结构性转变,以防止少数决策者进行“把关”(gatekeeping)。计算机科学家 Andy Konwinski 指出,当前的过程缺乏来自真正专家——即安全、对齐(alignment)和可解释性研究人员——的充分投入。
为了解决这一问题,未来出现了两种主要模式:
- 机构模式: 效仿 FDA 或 NIH,这将涉及召集研究人员、政府官员和私营公司,就安全标准达成共识。
- 第三方审计模式: 正如前政策顾问 Dean W. Ball 所建议的,政府可以授权独立的审计机构来评估前沿实验室的安全协议。
为了让 AI 生态系统实现长期稳定,行业必须摆脱私人谈判,转向一个可预测的、由专家驱动的框架,从而在受托责任与公共安全之间取得平衡。
核心要点
- 监管模糊性: 目前还没有标准化的“安全许可”或中央机构(如 FDA)来管理像 Sol 这样的前沿模型的发布。
- 透明度差距: 虽然 OpenAI 引用了来自英国 AISI 和 SecureBio 的外部评估,但政府的具体对话内容以及模型审批的技术要求仍然不透明。
- 专家呼吁: 行业专家正在倡导第三方审计和“开放公地”(open commons)框架,以确保安全决策是由研究人员而非政治中间人做出的。
