8/31 美国国防部正式在 GenAI.mil 门户启用 OpenAI 的 ChatGPT Mil 与 xAI 的 Grok for Government,与 2025 年 12 月率先上线的 Google Gemini for Government 并列,形成三模型工具箱。国防部披露,已有超过 170 万独立用户接入,约占 300 万合格军职、文职与承包商人员的半数以上——企业级软件很少见到这样的采纳速度。

一、三模型并列,各管一段

官方定位里,Gemini 偏搜索、ChatGPT 偏文本密集工作(规划、政策、行政、合同),Grok 偏深层推理与可复用工作区。ChatGPT Mil 当前运行 GPT-5.4 Terra,GPT-5.6 Terra 据称滚动推出;功能覆盖对话、文件、项目、自定义 GPT,以及返回引用的 Offline Search。由于认证针对特定构建,每一次模型更换都需纸质审批,所以政府版天然落后商业版一个版本——这是刻意的安全延迟,不是技术落后。

二、IL5 认证覆盖「托管架构」,不覆盖「模型行为」

三个模型均获 Impact Level 5 认证,这是国防部处理受控非密信息(CUI)的最高云层级,要求 421 项以上安全控制、专用基础设施、仅美国公民运维,并对接 NIST 800-53。但 IL5 认证的是「运行环境」,不是「模型生成的内容」——一个能生成不当内容的模型同样可以拿到 IL5,因为认证框架本为硬件与软件环境设计。这让「1.7M 用户 + 不可控生成」成为治理焦点。

三、Claude 缺席,暴露「使用限制」决定谁能上架

Anthropic 的 Claude 本被期待加入,却因在大规模国内监控、致命自主武器上的使用限制与国防部谈崩,一度被标为供应链风险;8/27 联邦法官撤销该认定并下发永久禁令,但 Claude 未出现在本次上架名单。对比 OpenAI 同样带限制却获准入场,公开记录未解释差异。对行业,这提醒:当 AI 进入国家机器,合同条款与使用政策会直接决定哪家模型能真正落地,技术能力反而不是唯一门槛。