NVIDIA要用上X3D堆叠设计!下代GPU将引入LPU单元
虽然NVIDIA目前在AI训练领域无可匹敌,用上引入元但面对日益增长的堆叠U单即时推理需求,其正筹划一项足以改变行业格局的设计“秘密武器”。
据AGF透露,下代NVIDIA计划在2028年推出的用上引入元Feynman(费曼)架构GPU中,整合来自Groq公司的堆叠U单LPU(语言处理单元),以大幅提升AI推理性能。设计
Feynman架构将接替Rubin架构,下代采用台积电最先进的用上引入元A16(1.6nm)制程,为了突破半导体物理限制,堆叠U单NVIDIA计划利用台积电的设计SoIC混合键合技术,将专为推理加速设计的下代LPU单元直接堆叠在GPU之上。

这种设计类似于AMD的堆叠U单3D V-Cache技术,但NVIDIA堆叠的设计不是普通缓存,而是专为推理加速设计的LPU单元。
设计的核心逻辑在于解决SRAM的微缩困境,在1.6nm这种极致工艺下,直接在主芯片集成大量SRAM成本极高且占用空间。
通过堆叠技术,NVIDIA可以将运算核心留在主芯片,而将需要大量面积的SRAM独立成另一层芯片堆叠上去。
台积电的A16制程一大特色是支持背面供电技术,这项技术可以腾出芯片正面的空间,专供垂直信号连接,确保堆叠的LPU能以极低功耗进行高速数据交换。

结合LPU的“确定性”执行逻辑,未来的NVIDIA GPU在处理即时AI响应(如语音对话、实时翻译)时,速度将实现质的飞跃。
不过这也存在两大潜在挑战,分别是散热问题和CUDA兼容性难题,在运算密度极高的GPU 再加盖一层芯片,如何避免“热当机”是工程团队的头号难题。
同时LPU强调“确定性”执行顺序,需要精确的内存配置,而CUDA生态则是基于硬件抽象化设计的,要让这两者完美协同,需要顶级的软件优化。
相关文章
发布者:小宁 浏览量:65发布时间:2026/9/9 15:19:43 果汁赛道内卷加剧,通货走量时代已成过去,不少经销商陷入“新品多、好品少,铺货易、动销难”的困局。在主流2026-10-01
Wintel将死!玩家狂喷微软:Intel反省了 Windows越来越烂
曾统治PC行业数十年的Wintel联盟,如今已出现难以弥合的裂痕。Intel近期推出的Panther Lake处理器,凭借惊艳的能耗控制和大幅跃升的核显性能广受赞誉,不仅有望夺回被AMD Strix2026-10-01
6日,宝岛工业总会副理事长、宝岛玻璃工会理事长林伯峰乘来汉参加“宝岛周”活动之机,率团前往东西湖吴家山台商工业园区进行实地考察。林伯峰宣布,其执掌的宝岛玻璃工业集团公司在汉投入2026-10-01
闽南网5月17日讯 “挺倒霉的,骑得好好的,却摔成这样。”昨天,林女士躺在家里休养,头上还包着纱布,缝了3针,医生说要在家休养一个星期。13日傍晚,她骑电动车从泉州市区一侧的江2026-10-01
随着我国绿色建筑不断推广,节能玻璃作为建筑节能中重要的一环,作用开始显现。业内人士指出,绿色建材始于节能玻璃。在节能玻璃中,Low-E三玻两腔中空玻璃获得绿色建筑的新宠。今天让我们一同揭秘Low-E三2026-10-01
导读: 牙齿问题,在中国,普遍缺乏牙齿保健意识是一大原因,但和“高昂”的牙科治疗费用也少不了关系。那么,保险能报销看牙的费用么?于是保险公2026-10-01

最新评论