☰
Agentic时代的卓越算力基石:读平头哥副总裁高慧2026云栖演讲
2026/10/8 23:13:14 网站建设 项目流程

基于 2026 云栖大会主论坛演讲《平头哥:Agentic时代卓越算力基石》· 演讲人:平头哥半导体副总裁 高慧 · 视频源:Bilibili BV1p3hE6iEgW

核心论断:在智能体(Agent)全面爆发的时代,AI 工作负载正在发生三大不可逆的剧变:算力重心由训练转向“推理优先”、负载形态由单轮请求转向“多步高频编排”、竞争维度由单卡性能跑分转向“算网存系统级协同”。平头哥正式发布新一代训推一体 AI 芯片真武 V900(算力达到上一代 3 倍),并规划支持 50 万卡广域超节点集群,为十万亿级模型构筑坚实自主的算力底座。


01 Agentic 时代,AI 算力面临的三大不可逆变革

平头哥副总裁高慧在演讲中指出,如果仅仅把 AI 当成单次问答工具,现有的芯片架构或许还能应付;但当企业级智能体大规模落地,底层算力正在遭受剧烈冲击:

  • 算力重心剧烈偏移 —— 推理优先:过去算力消耗主要集中在离线预训练阶段。而在智能体时代,随着数字员工的 7×24 小时在线运行,推理已经成为算力消耗增长最快、持续时间最长的核心负载。
  • 负载形态根本改变 —— 多步编排:一个简单的业务目标背后,可能包含十几轮模型深层思考、海量向量检索、代码反复执行和多次工具调用,算力开销在长上下文与高并发下呈指数级放大。
  • 竞争维度全面升级 —— 系统级协同:面对万亿甚至十万亿参数的大模型,单颗芯片的算力提升已无法弥补“显存墙”和“通信墙”,必须依赖芯片、高速互联、网络与存储的系统级联合寻优。

02 重磅发布:真武 V900 芯片与硬核参数解析

为了满足下一代大模型训练与极致低成本推理,平头哥正式发布了全栈自研的训推一体 AI 芯片真武 V900:

  • 3倍性能跃迁:真武 V900 单芯片综合算力性能达到上一代真武 M890 的 3 倍,是中国算力性能最强的自研 AI 芯片之一。
  • 216GB 海量显存:搭载 216GB 超大容量高带宽显存,片间互联带宽高达 1200GB/s,彻底缓解超大模型的显存容量与吞吐压力。
  • 原生低精度加速:硬件底层原生支持 FP8 与 FP4 低精度计算,在保障模型输出质量的同时大幅压低推理延迟与能源消耗。

高慧透露,真武 V900 预计将于 2027 年第一季度实现量产售卖;同时,平头哥已着手研发架构进一步突破的下一代芯片真武 J900(计划于 2028 年第三季度推出)。


03 消除物理边界:50万卡超节点集群与统一内存

如何让成千上万颗芯片协同如同一体?平头哥给出的解法是打造真正的“广域超节点”:

自研 ICN 互联总线:自研互联协议(ICNlink)与网络交换芯片(ICNswitch),实现全带宽低时延互联,单集群最高可扩展至 50 万张卡。
原生内存统一编址:打破传统物理服务器界限,让上层深度学习框架与算法“完全不感知数据位于哪台物理机”,将整个集群的显存汇聚为一个超大统一空间,上万颗芯片如同一颗巨大的超级芯片协同运转。


04 全栈自研版图与倚天 CPU 演进路线

除了 AI 专用芯片,平头哥在本次大会上首次完整公布了倚天系列服务器 CPU的未来蓝图:

  • 2027 年双代推出:2027 年将先后推出倚天 720 与倚天 730。其中,倚天 730 将首次采用平头哥全自研的 CPU 微架构,在单核能效比与高并发吞吐上实现突破。
  • 未来倚天 750 支持 ICN 直连:规划中的倚天 750 将原生集成自研 ICN 总线协议,实现与真武 AI 芯片的无缝直连协同,从根本上解决 CPU-GPU 之间的数据搬运瓶颈。
  • 已服务超 650 家企业:目前真武系列芯片已在智能驾驶、金融、具身机器人、制造等多个关键行业深度落地,为工业生产提供强劲的自主算力供给。

给算力架构与基础设施负责人的启示

算力新趋势硬件规划建议业务落地收益
推理优先时代优先部署原生支持 FP8/FP4 与大显存的 AI 推理卡将日常 Agent 运行的 Token 成本压低至原来的 1/3 以下
高频多步编排重点关注网络互联时延与片间带宽,避免小步通信卡顿提升多 Agent 协作与工具调用的端到端响应速度
全栈自研协同关注 CPU 与加速卡的总线级直连能力(如 ICN 架构)消除内存搬运开销,大幅降低长上下文 KV Cache 检索瓶颈

来源:2026 云栖大会主论坛演讲《平头哥:Agentic时代卓越算力基石》(主讲人:高慧)。内容经整理与工程化拆解,仅供技术讨论与学习参考。

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询