8月31日,据“IT之家”援引外媒“Android Headlines”报道,微软已开始收紧内部Token使用管理,设置用量监控并逐步将内部默认工作负载切换至OpenAI的GPT-5.6 Sol,以降低AI成本。
导火索是一份泄露的内部表格。一名微软员工在28天内产生了约2.8万美元(约合18.9万元人民币)的Token使用成本,引发高层担忧。有媒体报道称,这名员工大量刷量是为了“提高数据排名”,属于典型的“Tokenmaxxing”行为。
这组数据来自约350名美国员工的自愿提交。微软全球员工超22.3万人,月度AI使用成本中位数约300美元,但部门差异极大。CoreAI部门中位数最高,约975美元,个人最高达1.6万美元;Microsoft AI部门约490美元;Experiences and Devices约250美元;Azure约241美元。而2.8万美元的最高纪录来自Customer and Partner Solutions部门——一个非核心AI业务部门。
微软的应对分三步。一是上线Token用量监控,识别异常高支出账号;二是设置更严格的预算限制;三是把内部默认工作负载切换至更便宜的GPT-5.6 Sol,不再鼓励员工在编程任务中使用Anthropic Claude等第三方工具。
大厂普遍面临同样问题。据相关报道,Google今年初已将内部AI额度从无限制改为按项目申请;Meta内部AI工程师人均Token成本同比上涨380%。当大模型推理价格下降,但员工调用量以5到10倍速度增长时,企业总账单反而失控。