五角大楼 GenAI.mil 上线 ChatGPT Mil 与 Grok for Government:政府级 AI 采购的转折点

五角大楼 GenAI.mil 上线 ChatGPT Mil 与 Grok for Government:政府级 AI 采购的转折点

想象一下这样一个场景:你是美国国防部的一名文职人员,每天的工作是处理堆积如山的政策文件、后勤报告和行政备忘录。过去,你可能像所有人一样,下班后偷偷打开 ChatGPT 帮自己理一理思路,但你心里清楚,把涉及国防部内部事务的内容粘贴到一个消费级聊天机器人里,哪怕只是一份不涉密的采购清单,都是踩红线的事。于是你只能关掉浏览器,继续用最原始的方式一页一页地啃文件。

这种拧巴的状态,在 2026 年 8 月 31 日画上了句号。

那一天,美国国防部,或者按照它刚刚恢复的老名字”战争部”(Department of War),在自己的生成式 AI 平台 GenAI.mil 上同时上线了两款重磅工具:OpenAI 的 ChatGPT Mil 和 Starshield AI 的 Grok for Government。据战争部官方新闻稿,ChatGPT Mil 已通过 CUI 的 IL5 认证,面向国防部超过 300 万军职与文职人员,支持聊天、文件处理、项目管理和自定义 GPT 等核心功能。

这不只是一条科技新闻。如果你仔细看这件事的脉络,会发现它正在讲述一个更大的故事:全球最大的”甲方”,也就是政府,在采购 AI 时正从”押注一家”走向”同时养几匹马”。而这个转变,可能比任何一款 AI 模型的技术进步本身,都更深地改变整个行业的游戏规则。

一个平台,三个大脑

时间倒回到去年 12 月,GenAI.mil 刚上线的时候,搭载的是 Google Gemini,整个平台只有这一个模型。这在当时看起来很正常。大型组织采购 IT 系统,选一家供应商签个大合同,干净利落,管理成本最低。

但仅仅过了不到一年,画风就彻底变了。

现在 GenAI.mil 上并行运行着三个来自不同公司的 AI 模型:Google 的 Gemini、OpenAI 的 ChatGPT Mil、以及通过 Starshield AI 接入的 Grok for Government。三家公司,三种技术路线,三套各有侧重的能力体系,被装进同一个安全合规的平台框架里,供同一批用户按需选择。

为什么不继续只用 Gemini?据 TechCrunch 报道,国防部给出的官方理由非常直白:消除供应商锁定(vendor lock-in),同时推动更广泛的美国 AI 生态发展。

“供应商锁定”这个词在企业 IT 采购里已经被念叨了几十年,但放在生成式 AI 的语境下,它突然有了全新的分量。过去你锁定一家 ERP 供应商,最坏不过是迁移成本高一点,核心业务逻辑不会因为换了个数据库就面目全非。但如果你把一整个组织的知识工作流,起草文件、分析情报、辅助决策,全都建立在单一 AI 模型之上,当这个模型的能力被竞争对手超越,或者供应商的定价策略发生变化,你面对的就不是”换个系统”那么简单的事了。你面对的是整个组织的思维基础设施需要重新适配。

国防部显然想明白了这件事。与其在某一家身上 all in,不如从一开始就设计一个能容纳多个模型的平台架构。GenAI.mil 本质上变成了一个”AI 模型的应用商店”,底层是统一的安全合规框架和身份认证体系,上层则是可以灵活插拔的不同模型。

IL5 到底意味着什么

聊到这里,必须花一点篇幅解释一下 ChatGPT Mil 拿到的那个 IL5 认证,因为这可能是整个事件里最容易被忽略、却最有实质意义的细节。

IL5 是美国国防部信息系统安全认证体系中的一个等级,全称 Impact Level 5。简单说,它意味着这个系统被认定有能力处理 CUI,也就是受控非机密信息(Controlled Unclassified Information)。CUI 不是机密文件,但也不是随便能往互联网上扔的东西,它包括大量的内部规划文档、采购细节、人员调配信息、后勤数据等等。国防部日常运转中,绝大多数文书工作处理的都是这个级别的信息。

这就是为什么 ChatGPT Mil 的定位是服务于”文档密集型的非机密工作:规划、政策、后勤、行政”。它不是用来分析卫星图像或者制定作战方案的,那些是另一个安全等级的事。但它精准地切入了国防部体量最大、人数最多、效率提升空间也最大的那一块日常工作。

换个角度想:300 万军职和文职人员,他们中的大多数每天打交道的不是导弹发射代码,而是报告、备忘录、预算表格、政策解读。如果一个通过了 IL5 认证的 AI 助手能帮他们把这些工作的效率提升哪怕 20%,那乘以 300 万这个基数,释放出来的生产力是极其可观的。

这也给整个行业立了一个标杆:想做政府 AI 生意,光模型聪明没用,你得先过合规这一关。IL5 不是一张随便就能拿到的证书,它背后是对数据驻留、访问控制、审计日志、加密标准等一长串严苛要求的全面满足。OpenAI 能拿下这个认证,说明他们在企业级和政府级的安全合规投入上已经走到了一个相当深的位置。

从试点到采购范式的跃迁

ChatGPT Mil 的上线被官方定性为国防部与 OpenAI 在 2025 年建立的企业合作的”采用阶段”。这个措辞值得玩味。

在政府和大型组织的 AI 落地进程中,通常会经历几个阶段:先是某个部门的技术人员自己折腾一下概念验证(POC),然后是有限范围的试点,再然后是评估、审批、合规认证,最后才是大规模采用。从 2025 年签合作框架到 2026 年 8 月正式上线,这个节奏放在美国联邦政府的语境下已经算快的了。

而整件事由首席数字与人工智能办公室(CDAO)牵头推进,并且被明确说是呼应白宫的 AI Action Plan(AI 行动计划),这意味着这不是某个将军的个人兴趣项目,而是一个从上到下有政策支撑的系统性推进。

把这些线索串在一起看,国防部实际上正在建立一套政府级 AI 采购的新范式。这个范式的几个核心特征非常清晰:

第一,平台化。不是为每个 AI 工具单独搭一套基础设施,而是建一个统一的安全平台,让不同模型在同一个屋檐下运行。这大幅降低了接入新模型的边际成本。

第二,多供应商并行。从一开始就拒绝把鸡蛋放在一个篮子里。Gemini、ChatGPT、Grok 三家同台竞技,谁好用用谁,谁进步快就多用谁,谁掉队了可以随时调整比重。

第三,合规前置。不是先用起来再补安全手续,而是所有模型必须先通过相应的安全认证才能上平台。IL5 就是这道门槛。

第四,受控开放。据NOTUS 的报道,引入 Grok for Government 的一个重要理由是让员工不必再把数据发到消费级 App 上。这很务实。与其禁止员工使用 AI(禁也禁不住),不如给他们提供一个安全的官方替代品。

对普通开发者和企业意味着什么

你可能会觉得,五角大楼的事跟普通开发者和中小企业有什么关系?关系其实很大。

当全球最大、最有影响力的单一采购主体开始按这种范式采购 AI 时,它实际上在为整个市场定义标准。今天国防部要求 IL5,明天其他联邦机构、州政府、医疗系统、金融机构就会参照类似的合规框架来筛选 AI 供应商。这意味着什么呢?

如果你是 AI 厂商,光卷模型性能已经不够了。安全合规能力、数据主权保障、企业级管理功能(像 ChatGPT Mil 提供的 projects 和 custom GPTs),这些不那么起眼的东西正在变成竞标的硬门槛。OpenAI 拿下国防部,靠的不只是 GPT 的聪明,更是它在合规认证上的持续投入。

如果你是企业的技术决策者,国防部的做法给了你一个非常好的参考模板。与其纠结于”我们到底该选哪家 AI”,不如先想清楚:”我们能不能建一个平台,让多家 AI 在统一的安全管控下并行使用?”这不仅分散了风险,也让你在谈判桌上有了更大的筹码,因为每家供应商都知道你随时可以把流量切给竞争对手。

如果你是开发者,这个趋势意味着”AI 中间层”的机会正在变大。帮助组织搭建统一的 AI 接入网关、做模型路由和负载均衡、处理不同模型之间的格式适配和能力映射。这些听起来不如”训练一个更大的模型”那么令人兴奋,但它们可能是未来几年里最扎实的商业机会。

竞争格局的微妙变化

最后看看这次上线的”组合”本身。Gemini 来自 Google,ChatGPT Mil 来自 OpenAI,Grok for Government 通过 Starshield AI 接入,而 Starshield AI 的背后站着的是 Elon Musk 的 xAI 和 SpaceX 的 Starshield 防务部门。

三个模型背后是三个在 AI 领域激烈竞争的科技巨头,现在它们被要求在同一个政府平台上和平共处、直接比拼。这对用户来说是好事,竞争带来更好的产品和更合理的价格。但对厂商来说,这是一场持续的压力测试。你的模型在处理国防部典型文书工作时表现如何,300 万用户用脚投票,数据一清二楚。

这也意味着 AI 竞争的主战场正在从消费市场向政企市场迁移。在消费端,用户换一个 App 的成本几乎为零;但在政企端,一旦被选入像 GenAI.mil 这样的平台,你就获得了一个巨大的、有黏性的用户基座。国防部的 300 万人只是开始,如果这个模式被复制到其他联邦机构、盟国政府、大型国防承包商,那才是真正的规模效应。

反过来看,没有被选入平台的 AI 厂商,则面临着被排除在这个高价值市场之外的风险。这就是为什么即使 Grok 在消费市场上的份额远不及 ChatGPT 和 Gemini,它依然通过 Starshield AI 这条路径挤进了 GenAI.mil 的门。对 xAI 来说,错过这张入场券的代价实在太大了。

我们正站在什么样的转折点上

回到开头那个文职人员的故事。今天他打开 GenAI.mil,可以在三个 AI 模型之间选择,用一个通过了 IL5 认证的安全环境来处理手头的政策备忘录。这件事看起来平平无奇,但它背后的含义是:全球最强大的政府机构已经正式宣告,生成式 AI 不是玩具,不是实验,而是基础生产力工具,值得用最高规格的安全框架来部署,用多供应商策略来保障。

这是一个信号。它告诉所有还在观望的大型组织:别再纠结了,AI 采购的标准打法已经被定义出来了:建平台、多模型、合规先行、拒绝锁定。

它也告诉所有 AI 厂商:模型能力是入场券,但安全合规才是留在牌桌上的筹码。未来的竞争不只发生在论文和基准测试里,更发生在一个个具体的合规认证、一次次漫长的政府采购流程、以及数百万真实用户的日常使用反馈中。

生成式 AI 的”试玩期”正在结束。真正的”采购期”刚刚开始。而五角大楼,刚刚在这一页翻开了它最浓墨重彩的一笔。

延伸阅读

查看完整选型指南 →

Stay updated with our latest AI insights

Follow FuturePicker on Google
滚动至顶部