微软重拳整治内部“Tokenmaxxing”,AI算力浪费成行业隐忧

科技区角 2026-08-05 20:32

【科技纵览】当大模型调用成本成为企业不可忽视的财务黑洞,科技巨头们终于开始从粗放式使用转向精细化运营。据外媒 TechRadar 在 8 月 5 日晚间披露,微软正着手遏制内部工程师中日益蔓延的“tokenmaxxing”现象——即不计后果地高频调用 AI 模型,导致资源消耗远超实际工作需求。为此,执行副总裁杰伊·帕里克向全员发出邮件,明确将 Token 支出纳入关键资源管理体系,旨在扭转单纯追求调用次数的风气,转而聚焦于能切实推动业务变革的实际产出。

帕里克在信中直言,随着 GitHub Copilot 在各项目中的加速渗透,每位员工都需审慎对待 Token 的花费去向。公司并不鼓励这种极端的使用方式,而是希望通过更新内部指引,让每一分算力投入都能创造更大价值。作为配套措施,微软已将性价比更高的 OpenAI GPT-5.6 设定为内部默认模型,并计划自 2026 年 7 月起,为各部门划定具体的 AI Token 预算目标,同时允许员工实时查看个人支出明细。尽管具体上限尚未公开,但现有数据令人咋舌:部分工程师月度开销高达数千美元,普遍也在数百美元级别。

值得注意的是,这并非微软首次收紧 AI 工具权限。早在今年 5 月,就有消息称微软拟取消大部分内部 Claude Code 许可证,强制工程师在 2026 年 6 月 30 日前迁移至 GitHub Copilot CLI。帕里克强调,此举绝非阻碍公司向“AI 优先”战略转型,而是为了在模型迭代中优化政策,确保每个 Token 都能发挥最大效能。

事实上,算力浪费已成为困扰整个硅谷的难题。Uber 便是典型反面教材,员工大规模采用 Claude Code 和 Cursor 等智能体后,仅四个月便耗尽了 2026 全年的编程 Token 预算。亚马逊亦曾披露,其部署的一套基于 Claude Sonnet 的内部系统,最终耗资 180 万美元(约合人民币 1,217.3 万元),却仅用于处理琐碎事务,投入产出比严重失衡。这些案例表明,在具身智能与生成式 AI 狂飙突进的当下,如何平衡技术创新与成本控制,将是所有科技企业必须面对的长期考题。

关于科技区角:国内科技展会垂直内容策划服务商,提供从论坛内容全案策划、会展市场化IP打造到精准专业观众一站式邀约服务,以产业内容吸引高质量B端人群,打通展会从议题设计、演讲嘉宾邀约、宣传预热、精准邀观到供需对接全链路。
声明:内容取材于网络,仅代表作者观点,如有内容违规问题,请联系处理。
AI
more
刚和豆包视频完的我,已经开始重新认识AI了。
狐讯 | 中消协点名 AI 客服投诉激增;DeepSeek 开启二轮融资 500 亿
教别人PUA 的“大师”,被自己创造的AI 拿下了
SpaceX首份财报:AI狂飙背后的资本焦虑与市值震荡
微信开启灰度测试!语音新增指令功能,朋友圈上线AI帮写
Omdia:AI基建与供应失衡重塑270亿美元全球智能视频安防市场
MacBook Air 快断货了,等等党不能再等了
成立仅7个月,英伟达投的新公司,拿下Anthropic 680亿AI大单
离开OpenAI和Google后,两位大模型核心负责人决定卷下一代架构
代号「天线虾」!小米杀入AI天线全自动设计,高薪招募天线研究员
Copyright © 2025-成都区角科技有限公司
蜀ICP备2025143415号-1
  
川公网安备51015602001305号