随着人工智能应用对模型调用量的爆发式增长,国产算力的发展重点正从单纯的硬件堆砌转向系统级的能力输出。当前,我国日均词元调用量已呈现出惊人的增长态势,数据显示截至2026年3月,我国日均词元调用量已从2024年初的约1000亿激增至约140万亿。
面对这一算力需求井喷,海光信息在2026中国国际大数据产业博览会专业展上首发了“Agent to Token开放计算架构”。该架构的核心目标是为词元(Token)经济规模化发展提供一个从芯片到应用的全新算力框架。此举标志着国产算力正试图构建更具系统性和应用深度的解决方案。
在技术实现层面,海光Agent to Token架构的底层逻辑融入了“内生安全”理念,具体是通过内置平台安全处理器PSP来实现密钥可用不可见,从而确保密钥明文不会暴露。此外,该架构提出了四个开放维度:算力开放、互连开放、安全开放和软件栈开放,旨在构建一个全方位的生态支撑。
从硬件协同的角度看,海光Agent to Token架构采用了CPU与DCU双芯协同的模式。在此协作中,CPU承担了数据预处理、多智能体沙箱隔离、任务编排决策、记忆体分级存储和向量数据库检索这五大核心模块的系统枢纽职能。而DCU则聚焦于词元生成侧的并行计算加速,负责批量解码、KV缓存优化、预处理加速以及长序列支撑等关键任务。
算力互联能力的提升是另一个关键点。海光自主研发的高性能可扩展系统互连总线协议HSL突破了传统PCIe在带宽和延迟上的限制,该一套协议能够贯穿GPU-to-GPU、CPU-to-GPU、CPU-to-CPU、GPU-to-NIC以及GPU-to-SSD等多种互联通路,保证了数据流动的效率。
从产业趋势的判断来看,海光信息总裁助理兼智能计算产品部总经理杜夏威判断,算力供给正经历一个重要的转变期,即从“卖裸算力”转向“卖服务、卖能力”。这一观点强调了未来竞争的核心在于提供解决方案和使用场景的能力。
进一步细化对CPU能力的认知上,海光信息总裁助理兼服务器产品部总经理张攀勇指出,在Agent时代,对CPU的要求不再是单纯追求极强的计算能力,而是必须具备非常强的数据处理能力以及强大的带宽支撑。这与CPU承担数据预处理和任务编排决策等枢纽职能的定位相呼应。
从生态构建的角度看,光合组织产业生态创新中心以海光CPU+DCU自主算力为底座,链接超算互联网和安徽省算力资源,旨在构建一个“芯片—算力—应用—生态”全链条协同创新体系。这体现了国产算力正努力实现从单一产品到完整产业链的覆盖。
在商业化落地方面,海光信息已展示出一定的市场进展:海光信息总裁助理兼服务器产品部总经理张攀勇指出,海光已完成400余款大模型的适配,这些模型覆盖了全球绝大部分主流非闭源模型,并且已经在20多个行业、300多个应用场景实现了落地。此外,从公司运营数据来看,海光信息在2026年上半年实现营业收入90.99亿元,同比增长达到66.52%。
综上所述,国产算力正通过构建如Agent to Token这样的系统级架构、优化CPU与DCU的协同分工、提升互联带宽,并结合生态资源整合,来应对词元经济带来的巨大需求增长,实现从硬件销售到能力服务的转型。
(本内容信息来源于环球网报道的公开资料。)
信息来源
本文基于上述公开资料整理,未使用来源页面的图片、视频或嵌入媒体。