字节跳动日均Token调用量超50万亿 进军AI硬件与企业服务

字节跳动旗下火山引擎披露,截至2025年12月,豆包大模型日均Token调用量超过50万亿,半年内增长200%,较去年同期增长10倍,全球排名仅次于OpenAI和Google。

火山引擎总裁谭待表示,在AI云原生架构中,模型是软件核心。尽管当前Token消耗部分来自字节内部应用,但累计使用超万亿Token的外部客户已逾100家。

12月18日,火山引擎发布豆包大模型1.8版本,针对多模态Agent场景优化。为支撑高消耗,字节计划2026年投入1600亿元加码AI,其中约800亿元用于采购AI芯片,相当于其2025年净利润的四分之一。

应用层面,豆包App日活用户(DAU)于12月突破1亿,推广费用为字节历史上所有破亿产品中最高。该App将作为中央广播电视总台2026年春晚AI云合作伙伴,上线多种互动玩法。

在商业化策略上,火山引擎通过低价算力吸引硬件厂商。一家AI英语学习设备公司称,原本需数百万元本地部署服务器,现仅需数十元即可接入云端大模型。目前火山算力资源利用率未饱和,因此提供折扣价格,单用户年成本估算为50至80元。

相较之下,豆包助手API采取后付费模式:日常沟通0.1元/次,联网搜索0.2元/次,边想边搜0.5元/次,单价接近百万Token输入成本。该API已开放给开发者,并计划增加拍照识图、实时翻译等功能。

截至2025年12月,接入豆包大模型的AIoT设备从6月的100万台增至600万台。火山引擎推出玩具AI框架、音频AI框架等开发套件,授权形式包括三个月、一年及终身不限量使用。

谭待指出,企业客户占当前Token调用总量的80%,个人占20%。而国际对标数据显示,OpenAI有30家客户Token调用量过万亿,集中于教育、销售和编程领域。

为推动企业级落地,火山引擎发布Trae企业版,支持10万文件、1.5亿行代码容量;升级Agentkit平台并与多模态数据湖打通。字节内部超九成工程师使用Trae辅助开发,抖音生活服务40%以上代码由AI生成。

挑战在于Agent的身份权限管理及模型可解释性问题。现有业务系统非为Agent设计,难以实现安全可控调用。“不是模型不够强,而是缺少适配Agent运行的基础设施”,谭待称。

为降低成本,火山引擎推出“AI节省计划”,对按量后付费产品实行阶梯折扣,最高可节省47%费用;同时启动“方舟协作奖励计划”,截至2026年3月31日,企业最多获赠500万Token,个人200万Token,并实行消费多少返还同等有效Token的政策。

面对竞争,阿里云强调“有效的Token调用”而非单纯数量。其Qwen3-Next系列模型聚焦20万以上Token长上下文推理效率。阿里亦加快布局C端应用,千问App公测一周下载量破千万,夸克AI眼镜上市三天销量超3000台,钉钉发布企业级AI Agent硬件DingTalk Real。

行业人士指出,阿里云整体营收规模领先,覆盖IaaS、PaaS与MaaS;火山引擎则聚焦MaaS市场。模型质量不能单以Token消耗衡量,视频生成等任务天然消耗更高,且豆包依托抖音拥有大量内容创作者资源。

免责声明:本文内容由开放的智能模型自动生成,仅供参考。

最新文章
Copyright © DoNews 2000-2026 All Rights Reserved
京ICP备2025120072号