您的当前位置:首页 > 时尚 > NVIDIA要用上X3D堆叠设计!下代GPU将引入LPU单元 正文
时间:2026-10-10 00:09:29 来源:网络整理 编辑:时尚
虽然NVIDIA目前在AI训练领域无可匹敌,但面对日益增长的即时推理需求,其正筹划一项足以改变行业格局的“秘密武器”。据AGF透露,NVIDIA计划在2028年推出的Feynman(费曼)架构GPU中
虽然NVIDIA目前在AI训练领域无可匹敌,用上引入元但面对日益增长的堆叠U单即时推理需求,其正筹划一项足以改变行业格局的设计“秘密武器”。
据AGF透露,下代NVIDIA计划在2028年推出的用上引入元Feynman(费曼)架构GPU中,整合来自Groq公司的堆叠U单LPU(语言处理单元),以大幅提升AI推理性能。设计
Feynman架构将接替Rubin架构,下代采用台积电最先进的用上引入元A16(1.6nm)制程,为了突破半导体物理限制,堆叠U单NVIDIA计划利用台积电的设计SoIC混合键合技术,将专为推理加速设计的下代LPU单元直接堆叠在GPU之上。

这种设计类似于AMD的堆叠U单3D V-Cache技术,但NVIDIA堆叠的设计不是普通缓存,而是专为推理加速设计的LPU单元。
设计的核心逻辑在于解决SRAM的微缩困境,在1.6nm这种极致工艺下,直接在主芯片集成大量SRAM成本极高且占用空间。
通过堆叠技术,NVIDIA可以将运算核心留在主芯片,而将需要大量面积的SRAM独立成另一层芯片堆叠上去。
台积电的A16制程一大特色是支持背面供电技术,这项技术可以腾出芯片正面的空间,专供垂直信号连接,确保堆叠的LPU能以极低功耗进行高速数据交换。

结合LPU的“确定性”执行逻辑,未来的NVIDIA GPU在处理即时AI响应(如语音对话、实时翻译)时,速度将实现质的飞跃。
不过这也存在两大潜在挑战,分别是散热问题和CUDA兼容性难题,在运算密度极高的GPU 再加盖一层芯片,如何避免“热当机”是工程团队的头号难题。
同时LPU强调“确定性”执行顺序,需要精确的内存配置,而CUDA生态则是基于硬件抽象化设计的,要让这两者完美协同,需要顶级的软件优化。
滴滴拥抱AI浪潮的另一种方式2026-10-10 00:05
市安委会召开2015年度第一次全体会议2026-10-10 00:04
公司意外险一年多少钱?公司意外险多少钱一年?2026-10-09 23:32
火山引擎与周星驰比高集团达成版权合作,打造AI 视频 IP 合作新模式2026-10-09 23:29
玻璃漆的种类 怎样使用玻璃漆,行业资讯2026-10-09 23:22
最新医疗险测评,2022最新医疗险测评,最新医疗险产品推荐2026-10-09 22:57
玻璃 延续强势格局,行业资讯2026-10-09 22:36
喜报!网易荣膺国家科学技术进步奖,同源技术基因正驱动我们改变实体产业2026-10-09 22:17
玻璃漆的种类 怎样使用玻璃漆,行业资讯2026-10-09 21:58
媒体聚焦丨雅虎财经关注中联重科:加速打造全系列高端新能源产品2026-10-09 21:23
夏天来了,你们都离不开它!爆果忍着汽水需求旺盛,代理不断!2026-10-10 00:06
玻璃 延续强势格局,行业资讯2026-10-09 23:51
玻璃成本再降!纯碱供需逆转,开启暴跌模式,行业资讯2026-10-09 23:29
玻璃建筑模型的幻想曲,行业资讯2026-10-09 23:14
医保卡借给别人刷?会影响买保险吗?附常见问题!2026-10-09 23:08
鲁桂同心 风雨驰援!山东重工全力护航广西抗洪抢险第一线2026-10-09 22:50
《红色沙漠》1.07补丁更新 女主安全裤bug修复!2026-10-09 22:13
山海携手共筑健康路——新会区大泽镇卫生院公卫科主任林辉荣到宁明支医之路2026-10-09 21:46
蚂蚁灵波开源 LingBot2026-10-09 21:38
暗设违约“陷阱” 法拉利车主退款一波三折2026-10-09 21:33