把Token成本“打下来”:联想混合词元工厂推统筹Token成本、质量与安全

算力正成为像水电一样的基础设施,企业也开始计算Token这笔账——这是算力普惠逐渐走深向实的真实写照。与此同时,国家“人工智能+”行动与“东数西算”战略持续推进,算力资源的普惠化、便捷化、标准化已成为明确方向。国家数据局数据显示,2026年6月中国市场日均词元调用量已突破500万亿,到2030年将攀升至19306万亿。

产业焦虑随之而来。2025年智能体爆发,Token消耗指数级放大,企业从“先试起来”到“开始打鼓”——一个员工一天可能用掉1亿个Token,账怎么算清楚?近日,联想中国基础设施业务群战略技术总监黄山在接受媒体采访时,围绕Token经济提出了一个观察判断:企业真正焦虑的不是技术本身,而是这笔账算不清楚。这一观察,恰好切中了当前产业从“技术探索”走向“价值兑现”的核心命题。

Token工厂:算力普惠的产业形态

黄山指出,Token工厂不是智算中心,而是涵盖“顶层规划—数据Ready—智算中心—模型服务—工作流契合”的完整体系。Token工厂是一个能够标准化、有规模、可追溯、可预测、可结账的,生产智能的方式。

联想创新构建混合词元工厂解决方案,整合包括xCloud联想智能云、智算中心、万全异构智算方案、服务器、存储与数据网络等产品和能力,形成从云平台到基础设施的完整业务闭环。 “联想拥有把这些技术要素全部整合起来形成整体方案的能力。”

混合词元工厂的标准化、可结账特性,让算力像水电一样“即取即用”,降低千行百业使用AI的门槛,呼应“东数西算”算力普惠的战略目标。

技术拆解:成本“九层塔”与芯模适配

Token成本最大变量是计算,计算效率优化占三分之一强到二分之一。黄山将其拆解为“九层塔”:计算层7层优化,包括算子库、通信库、内存语义、推理框架并行策略等,每层叠加约两倍提升;硬件系统层,不同模型与芯片组合效率差异达30%-40%,GPU组成方式差异又达两倍;运营层,模型网关路由、智能体编排、Token Hub、FinOps、反时间碎片调度;基础设施层,IDC建设、用电选择、液冷等。

“一个Token的成本,它可以从十块钱最后降到一块钱。”黄山说,“我们的宣传语是,释放算力的每一分效能。”

芯模适配不是简单选型,而是系统工程——设计计算系统让模型跑得最有效率;联想大模型生态帮助用户根据场景选模型、适配芯片。降本才能让中小企业、传统产业用得起AI,推动“人工智能+”在实体行业真正落地。“供给侧一定要把成本打下来,然后应用才能繁荣起来。”

服务千行百业:从顶层规划到产业落地

联想咨询团队在十几个地级及以上城市,根据城市特色产业,进行从应用到工厂建设的完整规划并成功落地。从顶规设计到搭建整体,从智能体到芯片的方案,长期试错、重构生产流程。

黄山判断,AI的渗透仍循着之前的技术道路,并非所有场景都适合AI原生,需要系统性规划与行业Know-how。“AI的算法并不是能够替代所有算法,它只是在某些特定场景里,能够发挥巨大的新作用。”

未来变量:超节点与专用芯片

超节点,正在成为算力基础设施里最大的变量。

黄山判断,超节点将成为公有推理服务的新形态,替代传统集群算力形态。他援引华泰证券的分析,超节点在2025年的收入规模还比较有限;而随着推理场景开始采用超节点,市场将迎来年比年翻倍的爆发式增长。

背后的根本驱动力,是Scaling Law仍在发挥作用,让模型变得更聪明。黄山强调,超节点本身还在快速演进:“超节点将来会是公有推理服务的新形态,未来至少3年里边,超节点会不断演进。”

三年维度看,推理专用芯片路线同样值得关注。TPU、NPU、LPU各有优劣,自动驾驶芯片已经是明确赛道,科研和其他应用端也可能产生专用芯片。

算清一笔账,激活一个时代

Token经济不是概念,是必须算清的账。从混合词元工厂的产业形态,到成本“九层塔”的技术拆解,再到服务千行百业的落地实践,黄山所呈现的,是联想在这场算力普惠进程中的清晰角色:整体方案提供者,系统化能力整合者。

在“人工智能+”与“东数西算”的国家战略背景下,算力正从稀缺资源变成普惠基础设施。而普惠的前提,是有人把成本打下来、把账算明白、把方案落到产业里去。联想所做的,正是这样一件事:以系统化技术能力支撑算力普惠,让每一分算力都转化为实实在在的生产力。

“把成本算清楚,把投入产出算明白。释放算力的每一分效能,让每一分算力都转化为实实在在的生产力。”这既是黄山的判断,也是联想在这场Token经济变革中最务实的承诺。

Copyright © DoNews 2000-2026 All Rights Reserved
京ICP备2025120072号