2026中国算力大会于9月11日至13日在河北廊坊举行,本次大会的主题是“共织算力网 智启新未来”。在这一背景下,业界对衡量AI算力效率的关键指标进行了深入探讨。邹玥指出,算力中心真正的核心指标应聚焦于“每百万Token成本”,即总投入除以真正能交付的有效Token数量。
面对提升算力使用效率和降低运营成本的需求,翼华科技提出了其“端网协同”技术架构。该架构的核心思路在于实现应用端、网卡和网络设备之间的实时通讯与互相配合,旨在重构AI算力的Token成本结构。
为了具体化这一概念,翼华科技将“端网协同”技术架构命名为ELink。ELink由三大核心组件构成:端侧运行层(ERT)、网卡执行层(ERNIC)以及网络协同层(ERSW)。这三个组件的协同工作是实现其降本价值的关键。
从产品矩阵的角度看,翼华科技已规划出覆盖智能网卡(SmartNIC)、超级网卡(SuperNIC)与面向分布式推理的AI-DPU的完整产品矩阵。这一系列硬件能力的整合,为支撑“端网协同”架构提供了物质基础。
该“端网协同”方案在实际应用场景中展现出了显著的降本潜力。根据公开资料显示,此方案已在大模型训练、MoE推理、Prefill与Decode分离以及多租户与跨域调度等多个场景逐步体现出其价值。
从战略部署的角度来看,翼华科技将继续坚持“双芯驱动、全栈服务”的战略方针。通过结合端网协同架构和图南系列产品,助力算力中心实现降本目标。
本次大会的时间节点(9月11日至13日)标志着行业对算力基础设施优化进入了一个关键讨论期。业内人士关注点已从单纯的算力规模扩展,转向了如何通过软件定义和网络协同的方式,提升每一份计算资源的实际效能。
读者可以关注翼华科技后续如何将ELink架构与其产品矩阵结合,在不同业务场景中落地验证“每百万Token成本”的优化效果。本次信息来源于对2026中国算力大会相关报道的梳理。
信息来源
本文基于上述公开资料整理,未使用来源页面的图片、视频或嵌入媒体。