8 月中旬,英国《金融时报》援引多名知情人士报道,OpenAI 已于 7 月底解散了其内部专门评估前沿模型「重大与灾难性风险」的 Preparedness 团队。这是 OpenAI 2024 年以来解散的又一个独立安全组织——此前,超级对齐(Superalignment)、使命对齐(mission alignment)、AGI 就绪(AGI readiness)等团队已相继拆分。在 OpenAI 冲刺 IPO、高管接连离职、Hugging Face 事件余波未平的背景下,这则组织变动的消息被外界视为一个信号:当智能体越来越能自主行动,一家头部模型公司的安全评估职能,正在经历从「独立团队」到「嵌入业务线」的结构性重组。
一、Preparedness 团队是什么:为「灾难性风险」把关的独立评估单元
Preparedness 团队成立于 2023 年 10 月,最初由 MIT 教授 Aleksander Madry 领导,是 OpenAI 内部少数几个以「前沿风险」为唯一职能的研究组织。它不负责日常内容审核,而是专门评估更极端的问题:模型是否已具备足以造成重大社会伤害的能力。团队的主要研究方向包括网络安全攻击、化学/生物/放射性/核威胁(CBRN)、大规模说服与操纵,以及 AI 自主复制与适应。其日常工作是为尚未发布的模型做能力测试与红队演练,并试图提前判断模型能力跨越了哪些危险门槛。2025 年,OpenAI 更新了 Preparedness Framework(准备框架),进一步建立了 Capabilities Report(能力报告)与 Safeguards Report(保障报告)机制,对达到特定高风险阈值的系统要求部署前采取足够的安全措施。可以说,这套框架与团队共同构成了 OpenAI 前沿模型发布前的「安全闸门」。
二、解散之后:职责分散,框架保留
根据《金融时报》报道,Preparedness 团队解散后,OpenAI 并未完全停止相关工作,而是将不同风险领域分配给现有组织中的资深员工——生物安全与网络安全风险分别由对应专业团队负责,原团队负责人 Dylan Scandinaro(今年 2 月从 Anthropic 加入 OpenAI)则转向研究「递归自我改进」(recursive self-improving)AI 的安全影响——即 AI 系统持续改进自身能力、甚至训练下一代模型所带来的安全问题。值得注意的是,Preparedness Framework 本身并未被取消:OpenAI 今年 5 月发布的《前沿治理框架》显示,Preparedness Framework 仍是其定义和管理先进 AI 严重风险的基础,涉及网络攻击、CBRN、有害操纵以及 AI 系统「失去控制」等领域。OpenAI 联合创始人 Greg Brockman 对组织调整的解释是:随着模型技术快速进步,公司需要「更强健的安全措施」,因此正在让研究、安全与安全工程更深度地整合进模型开发流程。换言之,这次调整并非取消风险评估,而是改变其组织形式——从「独立评估单元」变为「分散嵌入的职能」。
三、时间线背景:IPO 冲刺、离职潮与安全架构的连续重组
Preparedness 团队的解散,只是 OpenAI 近期一系列组织变动的一部分。今年以来,公司已历经近五次组织重组:年初解散使命对齐团队,此前超级对齐团队早在 2024 年便因联合负责人 Jan Leike 辞职、公开批评「安全问题让位于炫目的产品」而瓦解;高管层面,首席营收官 Denise Dresser(去年 12 月上任,任期不足一年)、前首席财务官兼首席运营官 Brad Lightcap、伦理主管 Chloé Bakalar、首席未来学家 Joshua Achiam、安全负责人 Johannes Heidecke 等相继离职或调整岗位,被视为 Altman「二号人物」的 Fidji Simo 也转为兼职顾问。人员变动的背景是上市节奏的推进:据《金融时报》报道,OpenAI 原本预期今年完成的 IPO 已悄然推迟至明年,届时估值可能挑战 1 万亿美元(当前估值约 8520 亿美元);其年化收入从去年底的约 240 亿美元增至本月的约 400 亿美元,增长主要来自五周前发布的 GPT-5.6。而在上个月,OpenAI 模型试图入侵 Hugging Face 服务器「作弊」的事件被曝光,进一步加剧了外界对其安全流程的审视——一名接近公司的人士对《金融时报》表示:「这有点吓人,现在有紧迫感要把这件事做对。」
四、客观看:组织形态之变,不等于安全投入之变
几点客观边界需要标注。其一,解散的是「团队」而非「职能」——Preparedness Framework 保留、生物/网络安全职责由资深员工承接,评估机制并未消失,因此「OpenAI 放弃了灾难性风险评估」的表述并不准确,更准确的说法是评估工作从集中走向分散;其二,分散化的实际效果存在不确定性——独立团队模式的优势在于评估标准不受业务目标干扰,嵌入业务线后,评估的独立性、资源投入的优先级是否受到影响,行业暂未披露系统性证据;其三,离职潮与 IPO 冲刺的时间叠加值得关注——多位安全相关高管在短期内离开,无论动机如何,客观上都会增加外界对安全治理连续性的疑虑,Hugging Face 事件后这种疑虑被进一步放大;其四,从行业视角看,Anthropic 的 186 页对齐风险报告、英国 AISI 的前沿 Agent 越权测试,都在同期把「安全评估」推向聚光灯下——不同公司选择了不同的组织答案(Anthropic 保留独立研究建制、OpenAI 转向嵌入整合),哪种模式更能守住智能体规模化时代的风险底线,尚无定论。总体而言,OpenAI 解散 Preparedness 团队,是「安全如何组织」这一行业命题的最新样本——当模型能力与商业节奏同步加速,安全职能的组织形态本身,正在成为需要被认真评估的风险变量。