资讯
2026/7/22 15:38

新华三:全栈协同,做Token极致性价比的“系统级答卷”

0
0

C114讯 7月22日消息(水易)当前,大模型参数持续向万亿级迈进,万卡级算力集群逐渐成为行业标配。同时,智能体快速涌现,推动Token调用量和速度持续攀升,远超传统人机交互,目前国内日均Token调用量已迈入百万亿级时代,数字还在持续攀升。

这一背景下,巨额算力投入的价值兑现难题日益凸显,客户的核心关切不再是底层硬件选型,而是Token的响应速度和单位成本。前不久,Kimi宣布由于算力紧缺,暂停C端新用户订阅,待新算力到位后再逐步开放订阅,就是最好的例证。

为了回答这一问题,2026 WAIC期间,新华三集团以“打造Token极致性价比”为主题,基于“算-网-存-云-安-维”六大能力,呈现一套面向AI时代的系统级解决方案,致力于让客户的AI真正跑起来、用起来,让每一份算力投入切实转化为业务价值。

AI竞争升级:极致性价比的Token成为刚需

数据显示,万卡集群中,网络拥塞导致的算力损耗高达30%以上;数据IO瓶颈导致GPU空等时间占比40%以上;安全事件、维保故障、调度失误导致的训练中断,平均恢复时间以天来计算。

可以说,AI基础设施面临的核心矛盾一直没有变,即规模、效率、安全和运维。要把AI用好,首先要有足够的算力规模,有了规模后需要考虑算力的效率,最大化算力的价值。而安全和运维则是一直被行业低估,却恰恰是客户面临的最大挑战。

新华三认为,AI时代的竞争正在走向系统级的能效博弈,算力的简单堆砌无法承载智能洪流,必须走向“全栈协同”,通过“算-网-存-云-安-维”六大能力的深度耦合,实现更低的单Token成本与能耗。客户不再过多关注有多少颗GPU,更在意每瓦Token等核心指标,实现Token经济效益的最大化。

WAIC现场,新华三展台最显眼位置呈现的超节点产品正是上述理念的集大成者。H3C UniPoD S80000覆盖从32卡至1024卡规模全系列产品,最高可弹性扩展至16384卡,训练性能提升70%、推理性能提升3倍,为大模型训练、推理及行业智能化提供全场景支撑。

在新华三发布的《2026超节点技术白皮书》中提到,“超节点”架构的本质上是对计算、网络与存储边界的一次系统性重构。它不再局限于传统的单机物理框限制,而是通过高密度的背板互联或高速互联协议,将多个计算单元在逻辑上整合成一个超大规模的计算实例。

超节点架构一方面提供极致性能的AI算力,另一方面构建大规模、高带宽、低时延的AI芯片高速互联网络。通过让AI芯片算力与AI芯片互联能力最优匹配,形成“强算力×强互联”的高效架构,从而稳定支撑超大参数模型的训练、推理等应用。本届WAIC 世博展览馆内随处可见的超节点方案,也充分说明这一方向已成为行业共识。

全栈+工程化能力:充分释放每一份算力价值

超节点的构建不仅仅是“硬件堆砌”,极致的工程化能力是关键。新华三深耕行业20余年,对客户需求有着深入的了解,通过对智算网络、计算架构、存储介质等预研并验证,为实际落地积累工程化经验。

以网络为例,在新华三“算力×联接”战略中,网络是重要组成部分,也是超节点架构中的核心。新华三拥有全系列单芯片102.4T智算交换机及新一代智算广域网产品,依托“光电并行、算网调优、广域无损”三大方向的核心技术创新,有效解决不同层级算力互联的效能瓶颈,为高并发、大吞吐的智算业务提供坚实网络底座。

同时,新华三在计算、存储、安全、运维等领域同样积累深厚,技术及市场份额常年位居前列。计算产品矩阵涵盖高密全液冷整机及多款训推旗舰服务器。AI原生存储及XCache推理加速引擎,可大幅降低GPU训练等待时间。全新升级AI-Driven主动安全体系。灵犀运维智能体全面感知全栈设备的运行状态,让运维省力省心。

依托“算-网-存-云-安-维”全栈协同能力,新华三打造的灵犀智算解决方案,摒弃碎片化交付模式,覆盖Token从建设、运行、治理到调优的全生命周期。通过全栈软硬件的深度协同优化,实现Token生成全链路TCO下降30%以上、能耗成本降低40%以上的系统级成效,让企业真正实现“Token产出规模越大、单位成本摊薄越明显”的良性增长曲线。

坚持多元开放:构筑异构算力开放互联底座

在新华三“算力×联接”战略中,多元开放是重要组成部分。新华三秉持开放标准技术更具生命力的理念,围绕异构算力、算力互联、融合软件、整机系统和产业模式等多个维度协同推进。

在WAIC 2026期间举办的“AI算力技术架构创新论坛”上,新华三集团高级副总裁、技术委员会副主席刘新民介绍,新华三通过兼容多平台主流xPU芯片,打造灵活可选的异构算力底座;通过开放互联协议与算网深度融合,提升多元算力的连接效率和协同能力;通过算力资源融合与统一调度,打破资源孤岛,提升应用适配与部署效率;通过整机系统标准化和模块化设计,推动AI基础设施实现更高效率、更高可靠和可持续演进。

不过,随着国产多元算力加速发展,硬件架构各异、接口标准不统一、软件生态碎片化等问题,导致产业链重复开发、重复适配成本居高不下,成为制约异构算力高效协同的重要挑战。

在创新论坛上,由人工智能工委会牵引正式启动G-Link通用高速互连标准建设工作,面向AI高性能计算和Scale-Up互连场景,通过开放统一的互连架构和标准,降低产业适配成本,促进不同芯片、不同系统之间实现高效互联互通与协同创新,为超节点和大规模AI集群构建开放互联底座。新华三作为技术的贡献者和生态的倡导者,与AI产业链核心伙伴代表共同见证了G-Link标准面向产业开放迈出关键一步,为多元异构算力高效协同和开放智算生态建设提供新的支撑。

多元开放还体现在AI赋能百行百业应用层面。新华三打造的图灵小镇模式,通过算力服务、技术研发、场景应用、产业孵化,把算力和模型变成像电力一样“随取随用”的公共设施,让创业者不再为底层门槛发愁,拎包入住,即刻创新。目前,新华三已在全国十多个省市落地实践,数百家核心企业入驻。

同步发展的芯模社区,作为国产芯片与大模型的“试金石”和“中试场”,大幅缩短技术从实验室到市场的周期。目前,芯模社区已涵盖10多种主流芯片型号,已配套形成由90多种大模型、60多种镜像构成的高价值算力资源库,形成了5000套行业最优组合方案。

值得一提的是,新华三还打造了面向算力、模型、任务与Token的一体化运营管理平台图灵Token工厂,向上承接模型任务与应用请求,向下统一调度GPU资源与算力分配,将分散的算力消耗转化为可量化、可管理、可运营的Token生产力,充分释放每一份算力价值。

当每一颗芯片的算力都能被高效调用,当每一个模型都能找到适配的场景,AI便不再是少数巨头的游戏,而成为百行百业触手可及的创新引擎。新华三将持续推动“算-网-存-云-安-维”深度融合,把每一台产品做到极致、每一个方案做到最优,打造Token极致性价比。

版权说明:C114刊载的内容,凡注明来源为“C114通信网”或“C114原创”皆属C114版权所有,未经允许禁止转载、摘编,违者必究。对于经过授权可以转载我方内容的单位,也必须保持转载文章、图像、音视频的完整性,并完整标注作者信息和本站来源。编译类文章仅出于传递更多信息之目的,不代表证实其描述或赞同其观点;翻译质量问题请指正

给作者点赞
0 VS 0
写得不太好

C114简介     联系我们     网站地图

Copyright©1999-2025 c114 All Rights Reserved 沪ICP备12002291号-4

C114通信网版权所有 举报电话:021-54451141 用户注销