云天励飞公布算力路线图:涵盖AI推理芯片和超节点异构集群
最新7月19日消息,“云天励飞”公众号发文,云天励飞在2026 WAIC上正式披露了未来两年AI推理芯片的路线图,计划推出DeepVerse 100P、100D和100L三款云端大算力芯片,分别针对Prefill、Decode及Decode内部FFN环节的负载特征进行专用优化。

当前,大模型推理应用正加速分化为三类典型场景:以对话和知识问答为代表的通用AI助手,以复杂推理和编程为代表的深度推理应用,以及以Agentic Coding、多智能体协同为代表的实时智能体系统。
随着应用不断深入,单次任务的上下文长度、推理链路复杂度与实时响应要求持续攀升,对推理系统的吞吐能力、延迟控制和成本效率提出更高挑战。在大规模部署中,峰值算力已难以单独衡量系统效能,计算、访存、互联与调度等因素共同决定着Token生成的成本与质量。
与此同时,大模型推理不同阶段的计算特征日趋分化。Prefill阶段需集中处理长输入上下文,对算力要求极高;Decode阶段以逐Token生成方式运行,对内存带宽和访存效率更为敏感;而随着MoE等模型架构的普及,Decode内部的Attention与FFN子模块在计算密度与访存模式上也呈现出显著差异。

传统“一芯通吃”的混部架构,往往因资源共享导致资源争抢,制约整体效率。
基于这一洞察,云天励飞设计了三款专用芯片,并面向万卡异构集群进行协同部署,通过对推理阶段的解耦,为不同环节分配最适配的算力资源,系统化降低Token生成成本。
DeepVerse 100P:专为百万级上下文Prefill场景打造,避免与Decode共享算力和带宽,消除长上下文处理对生成吞吐的影响。
DeepVerse 100D:面向Decode环节的专用推理引擎,提供数倍于主流芯片的内存带宽,支持1024卡级Scale-up及光互联架构。通过按需动态建立光路直连,并依据任务实时重构链路,大幅减少传统多跳电交换中的排队、拥塞和中间转发开销,降低通信尾延迟,保障逐Token生成的稳定输出。
DeepVerse 100L:针对Decode阶段中计算密集型的FFN环节,采用3D Memory架构,相比主流HBM显著提升带宽;配合低延迟芯片互联和激活数据快速传输,提高计算与通信的并行效率。
三款芯片协同配合,有望在推理全链路中实现更精细的资源匹配,为未来AI应用的规模化落地提供高效、低成本的算力底座。

《云天励飞公布算力路线图:涵盖AI推理芯片和超节点异构集群》转载自互联网,如有侵权,联系我们删除,QQ:369-8522。
相关图文
-
只缺5%就敢涨价500% 内存三巨头太狠了:夸大短缺程度
快科技7月19日消息,这一轮内存闪存大涨价主要源于AI需求太大导致的供应失衡,一年来内存条价格涨了差不多500%,部分产品甚至有接近10倍的涨幅。按照这样的涨价情况,大家原本以为内存行业的产... -
四十岁微星的BW 2026:沉寂七年闪电归来、四十周年全家桶齐亮相
在刚结束的Bilibili World 2026上,微星展台被围得水泄不通,不是没有原因的。正值品牌成立四十周年的微星,在今年的展会上全面展示了四十周年天龙座限量版套装领在内的硬件产品线。作为微星展... -
RTX 3080丧心病狂堆散热:360mm水冷+11个风扇全上!结果只提升不到5FPS
快科技7月19日消息,博主TrashBench在一块华硕ROG RTX 3080上用上了11个风扇外加一套360mm一体式水冷,GPU温度从70℃暴降至41℃,但游戏帧数提升却极其有限。实验对象华硕ROG Strix GeForce R... -
RTX 50 SUPER系列无限期搁置!显存太贵了
快科技7月19日消息,据报道,NVIDIA已通知板卡合作伙伴暂停GeForce RTX 50 SUPER系列显卡的发布计划。消息人士确认,显卡已经在合作厂商处实物就位,至少一家AIB厂商已经收到成品显卡,硬件就... -
云天励飞公布算力路线图:涵盖AI推理芯片和超节点异构集群
快科技7月19日消息,“云天励飞”公众号发文,云天励飞在2026 WAIC上正式披露了未来两年AI推理芯片的路线图,计划推出DeepVerse 100P、100D和100L三款云端大算力芯片,分别针对Prefil...












