从“流量经营”到“词元经营”:海光“双芯”如何夯实数字经济算力底座?

来源:环球网2026-09-10 11:00

【环球网科技报道 记者 李文瑶】9月9日,在2026中国联通合作伙伴大会上,海光信息首次推出“面向词元(Token)经营的双芯加速解决方案”。在“向智同行,连接算力新生态”的主题下,海光信息给出了“双芯”解决方案,直接指向了运营商正在全力探索的新命题——如何从“流量经营”的管道商,转型为“词元经营”的算力服务商。

2026年,《政府工作报告》首次提出“打造智能经济新形态”,标志着我国从数字经济迈向智能经济的新阶段。今年4月,算力网首次被纳入国家“六张网”战略性基础设施阵列,与水网、新型电网、新一代通信网等置于同等重要位置。中共中央政治局会议明确提出,加强水网、新型电网、算力网、新一代通信网等规划建设。就在大会前夕,国家发展改革委披露,截至今年3月底,我国已建成智能算力规模188.2万P,相当于去年同期的2.5倍,预计还将保持高速增长态势。

算力规模高速扩张的同时,一个行业问题也浮出水面:算力建起来了,谁来运营?怎么变现?如何让每一分算力投入都能算清楚经济账?

“传统算力销售模式已无法满足AI时代的精细化运营需求。我们需要一套能够度量、调度、变现每一个词元价值的系统级方案。”海光信息销售副总裁高明在采访中说道。

不止于算力供给:一套“会经营”的算力方案

当前,大模型训练与推理的算力需求呈指数级增长,但行业普遍面临一个尴尬现实:算力集群建起来了,GPU利用率却长期徘徊在低位;大模型跑起来了,成本却算不清楚——一个词元值多少钱?不同业务的词元该如何定价?哪些词元带来了实际收益?这些问题,传统的算力交付模式还回答不了。

海光此次发布的“词元经营双芯加速解决方案”,恰恰切中的就是这个空白。

最核心的亮点在于“双芯协同”的系统级架构。 与市面上大多数算力方案仅聚焦于单一加速芯片不同,海光方案重新梳理了CPU与DCU的分工逻辑。海光CPU不再只是“配角”,而是扮演“总调度师”的角色——凭借拓扑感知能力,智能对齐GPU内存分配与NUMA节点,统筹编排、工具调度及记忆管理等复杂任务;海光DCU则专注“计算引擎”职能,承担并行计算加速、P/D分离优化、批量解码、KV缓存加速及长序列高效处理。双芯通过高效的数据协同与内存协同机制,实现业务流量的智能分流与动态调度。这套协同架构将竞争维度从单卡算力峰值比拼,直接拉升至“CPU+DCU+集群+调度”的系统级层面。海光是国内少数同时具备原生兼容x86架构高端通用CPU及“类CUDA”架构DCU研发能力的芯片企业之一,这种“双芯”底座的独特优势,使其在系统级协同调度方面具备了其他国产算力厂商难以复制的技术纵深。

另一个独特之处在于“四维开放”的生态设计。 长期以来,国产算力生态面临封闭、碎片化、适配门槛高等困境,用户在构建算力平台时往往面临被单一厂商锁定的风险。海光从算力、互连、安全、软件栈四个维度全面开放:算力开放支持双芯原生组合及异构芯片交叉适配;互连开放依托自研HSL高速互连协议突破带宽瓶颈;安全开放以芯片级内生安全构筑全链路可信防护;软件栈开放适配百余种主流AI框架,大幅降低迁移与开发门槛。这套标准化对接框架,为运营商提供了不被“绑架”的可持续进化底座。

更具前瞻性的是其“面向词元经营”的设计理念。方案覆盖词元“生产—调度—计量—成本核算—应用变现—复购扩容”的完整价值周期,这意味着它不仅仅是算力硬件,更是一套包含了计量工具、成本分摊、应用封装和运营看板的完整体系。运营商可以据此清晰回答“每一个词元的成本是多少”“哪些场景的词元回报率最高”“算力扩容应该在哪个环节优先进行”等经营层面的核心问题。

运营商的“算力账本”:为什么必须走向“词元经营”

如果说海光方案的技术架构回答了“怎么做”的问题,那么更本源的问题在于:运营商为什么迫切需要这样一套方案?

答案藏在数字经济底层逻辑的变迁中。

过去三十年,运营商的商业模式建立在“流量”之上。话音分钟数、短信条数、数据流量MB/GB的消耗量,构成了清晰的计费单元和收入模型。但AI时代,算力正在取代流量成为新的核心生产要素,而算力的价值和成本无法用简单的FLOPS或带宽来衡量。

词元,这个大语言模型处理文本的最小单位,正在成为数字经济时代新的“货币”。2026年3月,国家数据局正式将Token的中文名定为“词元”,终结了概念的混乱,赋予其可计量、可定价、可交易的属性。新华社在相关报道中指出,“词元经济”是一种以词元为交付方式、计量和定价单位的经济模式,是人工智能时代的产物。今年7月举行的2026世界人工智能大会提出“打造智能经济新形态,培育以大模型为基础、智能体驱动为引领的词元经济新模式”,为人工智能服务的价值衡量、资源配置和规模化应用提供了清晰指引。

词元经济的规模增长令人瞩目。3月23日召开的中国发展高层论坛2026年年会透露,今年3月,中国日均词元调用量突破140万亿,相比2024年初的1000亿,两年增长超千倍。中国信通院数据显示,预计年底可达到300万亿至400万亿。一个智能客服回答一次提问,消耗几十个词元;一份行业研报的生成,可能需要上万词元;一个复杂智能体完成跨系统操作,词元消耗量更是呈指数级增长。词元的消耗量直接决定了AI服务的成本与质量,也直接关联到运营商的收入与利润。

这正是运营商从“流量经营”走向“词元经营”的战略必然。 三大运营商已将“Token经营”写进了2026年的战略主线。中国电信明确提出“以Token经营重塑公司业务”;中国联通提出“Agent+Token+AI云”的算力经营新模式;中国移动则在2026移动云大会上正式发布Token运营生态体系。

但理想与现实之间仍有距离。运营商目前仍停留在算力基建扩张阶段,尚未建立起真正的Token计价、Token结算和Token服务能力体系,这是运营线需要补齐的短板。

而词元要成为普惠性的数字生产力要素,核心在于降低全社会获取词元的边际成本——算力网络正是破局的关键。运营商作为“链长”,核心使命是通过构建“全国一体化算力网”,将分散的算力资源编织成一张低时延、高可靠的算力网络。

国产算力规模化应用的需求同样迫在眉睫。 在国家算力枢纽节点建设和“东数西算”工程加速推进的背景下,运营商承担着国产算力“用起来”“跑起来”的关键责任。海光方案通过双芯协同提升单节点效率、通过四维开放降低生态门槛、通过词元经营闭环实现价值可量化,为运营商规模化部署国产算力提供了从芯片到应用的全栈支撑。Token在此成为连接算力供给、数据要素与行业应用的“通用语言”,而运营商凭借其平台优势,成为这场价值交换中不可替代的组织者。

从“产品交付”到“长期价值共生”:产业生态的重建

此次海光解决方案的发布,在这场大会上传递的最重要信号,在于对“生态”二字的强调。

海光并未将重点落在参数对比上,而是反复强调一个关键词——光合生态。所谓“光合生态”,是希望通过开放底层能力,联合整机厂商、基础软件厂商、行业应用伙伴乃至最终用户,共同进行产品适配与联合创新。

这一战略定位的底层逻辑在于:算力产业的竞争已从单一技术参数的比拼,转向生态体系的对抗。 无论是国际巨头的行业生态,还是国产算力阵营各自为战的软件栈,都在证明一个道理——没有生态的算力是“孤岛”,无法真正融入产业毛细血管。

海光的选择是“开放”与“协同”。从技术层面看,方案覆盖硬件基础层、集群系统层、软件生态层和服务运营层四个纵向维度,并通过P/D分离、KV Cache优化、模型与算子融合、MaaS/API及Token计量等能力,更贴近运营商真实AI服务运营需求。从产业层面看,海光正联合整机、基础软件和行业应用伙伴,推动CPU、DCU及异构加速硬件实现统一调度与协同运行,为运营商及行业用户提供更加灵活的国产算力选择。

海光的“双芯”方案,切中了自主可控、持续进化这些需求点。借助该方案,中国联通可以实现对算力资源的精细度量与差异化定价,为金融、能源、制造等行业客户提供基于Token消耗量的精准账单和运营建议,让行业客户真正看清AI投入产出比,从而加速实体经济数字化转型的步伐。

面向未来,这一合作的战略意义还将持续放大。 国家发展改革委初步估算,今年“六张网”及相关重点领域建设投资规模将超7万亿元,算力网直接投资将达到万亿量级。“十五五”时期,算力网建设将新增直接投资4万亿元。随着智能体应用的爆发和算力需求的持续攀升,复杂的多智能体协同调度对算力基础设施提出了更高要求——既需要弹性伸缩的计算能力,也需要精细到每一个Token的计量与调度,还需要跨品牌、跨架构的异构算力统一管理。海光方案所代表的“系统级协同+全栈开放+价值运营”的技术路线,正在为算力网络的演进提供一条可落地的中国路径。

从“流量经营”到“词元经营”,一词之差,意味着一个时代的转身。它也代表着中国信息通信产业正从基础设施的规模化建设,迈向深度挖掘数据要素价值、精细化运营数字生产力的新阶段。