算力账单持续走高 大厂收紧AI Token用量 内容创作团队直面成本波动考验,普通用户暂时没有受到影响

  原因

算力账单持续走高 大厂收紧AI Token用量 内容创作团队直面成本波动考验,普通用户暂时没有受到影响-第1张图片

  控制成本防止浪费 ,减少高额无效支出

算力账单持续走高 大厂收紧AI Token用量 内容创作团队直面成本波动考验,普通用户暂时没有受到影响-第2张图片

  除了字节跳动 、腾讯完成内部Token额度精细化改革外,阿里 、京东、美团等国内头部互联网企业也同步出台限流规则,以压缩无效Token消耗。

算力账单持续走高 大厂收紧AI Token用量 内容创作团队直面成本波动考验	,普通用户暂时没有受到影响-第3张图片

  有大厂员工透露,行业普遍无额度限制、无场景约束,不少员工滥用高端付费大模型处理简单办公 、检索、总结 文案等基础工作 ,甚至为冲考核、堆工作量刻意刷取无效Token,叠加Agent循环调用 、长文本无意义生成等行为,造成企业算力成本持续无序飙升 ,资源浪费问题愈发严重 。

  专家认为,此番全行业收紧Token使用规则,核心目的就是出清算力泡沫、杜绝无效成本内耗 。从行业落地数据来看 ,头部互联网企业完成Token精细化管控后,在不影响正常业务开展的前提下,整体外部AI算力采购成本可下降40%~60% ,部分管控彻底、模型替换全面的企业 ,无效算力成本降幅可达70%。有业内人士结合字节跳动官方报销新规 、全员岗位配比及研发人数测算,仅外部第三方模型采购费用一项,字节跳动每月即可减少超亿元的无效AI开支 ,单月可节约算力成本超1亿元。

  海外科技同样因成本问题对Token使用限流 。Uber全年34亿美元AI总预算,仅4个月就耗尽,工程师单人月均Token开销高达500美元至2000美元 ,成本失控速度远超企业预期。Meta曾推行Token消耗排名 榜激励员工使用AI,放任全员无上限调用算力,直接导致单月员工总Token消耗突破70万亿 ,月度算力成本超1亿美元,高额无效支出倒逼平台紧急叫停用量排名机制,为全员配发固定算力配额 ,严控无效调用。与此同时,微软、亚马逊也相继关停第三方高价模型内部授权,废除AI用量考核榜单 ,全面开启算力成本精细化管控 。

  为何大厂纷纷对员工限流?曾在腾讯网络安全部门任职的科技行业从业者李铁军分析 ,AI算力背后是高昂的成本,核心压力集中在GPU硬件采购运维与机房电力消耗两大板块。

  硬件层面,支撑大模型运行的高端GPU采购单价极高 ,企业需批量采购组建算力集群,前期硬件投入动辄数十亿元;同时高负载持续运算会大幅缩短显卡、服务器等设备的使用寿命,设备更换 、日常维修保养都会持续产生大额支出 ,无节制调用Token会加速硬件老化,拉高长期设备摊销成本。

  电力层面,算力集群24小时不间断高负荷运转 ,机房制冷、设备运行均会产生巨额电费,批量、无意义的Token调用会持续增加机房能耗开支 。双重成本叠加下,放任员工无上限使用AI会造成企业算力费用无序暴涨 ,这也是各大互联网企业出台Token配额 、限制员工滥用算力资源的核心原因。

  影响

  C端用户基本无感,B端专业团队直面压力

  很多人对此现象产生疑惑:大厂严控内部Token,普通人日常用AI会不会变少 、热度持续下滑?国家数据局公开数据显示 ,国内大模型日均Token调用量持续攀升 ,豆包、文心一言等国产C端产品月活、日均对话量连续8周上涨,全民AI渗透率突破72%,8亿网民常态化使用AI工具。

  记者调查发现 ,此次大厂政策调整对普通大众用户几乎无影响 。普通用户日常仅使用AI进行简单问答 、文案润色、生活询问 、轻度配图等场景,单次Token消耗极低,使用频次 、调用总量有限 ,远未触及平台限流阈值。

  因而,真正受到显著冲击的,是依赖大算力、高频批量调用AI的专业从业者与中小内容企业。广州科韵路某游戏公司从业者表示 ,游戏初创公司对算力需求大,算力对其成本影响更大,在不同平台购买Token ,成本浮动多达数万元 。

  应对

  不少平台借机降价抢用户和市场

  记者梳理行业最新动态发现,本轮Token成本管控呈现明显差异化格局,并非所有大模型供应商都选取 收紧配额、抬高使用成本 ,不少平台反向调整策略 ,通过降本 、降价、优化算力体系抢占市场 。以金山办公为代表的企业走出差异化路径,搭建精细化Token统筹体系,依靠资源整合、拦截无效算力 ,直接降低内部员工办公AI的Token使用成本;国产大模型厂商DeepSeek此前更是推出大规模永久降价方案,旗下V4-Pro整体降幅达75%,缓存命中场景百万Token单价低至0.025元。

  有业内分析师表示 ,大厂收紧商用B端Token额度是为了减少无效算力损耗,而对普通用户 、中小开发者降价让利是核心竞争策略。用户体量直接决定大模型数据迭代速度与市场话语权,厂商愿意压缩商用业务利润 ,持续下调调用成本、放宽免费额度 。7月7日,微信公开课发布消息,小程序成长计划再度升级 ,全面搭载混元Hy3大模型与Hy Image 3.0生图模型,大幅加码AI算力扶持,降低开发者落地AI小程序的成本。据介绍 ,本次升级核心资源实现10倍扩容 ,大模型Token额度由1亿提升至10亿,AI生图额度增至10万张,资源包申请后6个月有效。

  与供需紧张形成鲜明对比的是Token定价的混乱 。共绩算力联合创始人王鹏早前曾表示 ,当前Token市场呈现“各自定价、各自为战 ”的态势,不同平台 、不同模型下同一量级的Token费用 可能相差数倍,“有的百万Token只要两元 ,有的要几十元,普通用户很难判断其真实价值。 ”

  名词解释

  Token

  Token中文名为词元,是AI大模型识别 、处理信息的最小基础单位。和AI对话、查询问题、生成文字 、分析内容时 ,所有输入与输出信息,都会被拆解为Token完成运算 。AI的算力消耗、额度限制、收费定价,全部以Token作为统一核算依据。近来 国内没有统一收费标准 ,轻量化经济型模型每百万Token低至0.4~2元,旗舰高端模型每百万Token可达10~60元,不同厂商 、不同能力等级模型价差悬殊。

(文章来源:信息时报)

文章推荐

  • 疫情后旅游怎么选取地区(疫情后旅游怎么选取地区比较好)

      原因  控制成本防止浪费,减少高额无效支出  除了字节跳动、腾讯完成内部Token额度精细化改革外,阿里、京东、美团等国内头部互联网企业也同步出台限流规则,以压缩无效Token消耗。  有大厂员工透露,行业普遍无额度限制、无场景约束,不少员工滥用高端付费大...

    2026年07月22日
    6
  • 中国疫情黄色地区有哪些/中国疫情区域有哪些

      原因  控制成本防止浪费,减少高额无效支出  除了字节跳动、腾讯完成内部Token额度精细化改革外,阿里、京东、美团等国内头部互联网企业也同步出台限流规则,以压缩无效Token消耗。  有大厂员工透露,行业普遍无额度限制、无场景约束,不少员工滥用高端付费大...

    2026年07月22日
    6
  • 【浙江省疫情高危地区,浙江省疫情高中低风险地区】

      原因  控制成本防止浪费,减少高额无效支出  除了字节跳动、腾讯完成内部Token额度精细化改革外,阿里、京东、美团等国内头部互联网企业也同步出台限流规则,以压缩无效Token消耗。  有大厂员工透露,行业普遍无额度限制、无场景约束,不少员工滥用高端付费大...

    2026年07月22日
    7
  • 国外限行/国外限号限行措施

      原因  控制成本防止浪费,减少高额无效支出  除了字节跳动、腾讯完成内部Token额度精细化改革外,阿里、京东、美团等国内头部互联网企业也同步出台限流规则,以压缩无效Token消耗。  有大厂员工透露,行业普遍无额度限制、无场景约束,不少员工滥用高端付费大...

    2026年07月22日
    6