美国陆军 AI 额度告急:全年 token 几周耗尽,限额重新上线
美国陆军宣布"无限量"AI 权限后约 45 天涌入 1.9 万用户,年度 token 额度提前烧光,只能重新恢复用量上限。
据 Wired 率先报道、Ars Technica 7 月 22 日跟进,美国陆军已恢复对其企业级生成式 AI 平台的用量限制——官兵和文职人员在数周内耗尽了全年的 token 额度。陆军作战能力发展司令部(DEVCOM)的成员收到邮件通知:由陆军 CIO 出资的 token 池已经用完,限额措施重新生效。
短命的"无限量"
陆军企业 LLM 工作区(Army Enterprise LLM Workspace)基于 Ask Sage 搭建。这是一个模型中介平台,让政府用户通过约 4900 万美元的五年期合同调用商业前沿模型,包括谷歌 Gemini、Meta Llama 和 OpenAI 的模型。今年 5 月,陆军 CIO 宣布向全员开放无限量使用,采用率随即爆发:约 45 天内涌入约 1.9 万名用户。到 6 月中旬,消耗量已击穿全年预算配额,陆军只能收回"无限量"承诺,恢复按人限额,同时重新谈判扩容。
这几乎是一次教科书级的 AI 需求自然实验:放开限制后,庞大的机构员工并没有把生成式 AI 当新鲜玩具,而是在一个半月里吃掉了一年的推理预算。
为什么重要:token 计费的行为模式与企业 IT 预算长期依赖的"席位授权"完全不同,陆军刚刚在机构级规模上演示了这种错配的后果。对五角大楼而言,这既是难堪也是验证——政府内部对 AI 工具的真实需求巨大,但采购模式远远落后于按用量计价的现实。所有正在内部推行"无限量"AI 权限的大型组织都该引以为鉴:先测消耗,再做承诺。而在供应商眼中,这恰恰预示着政府 AI 订单即将大幅膨胀。