您的当前位置:首页 > 休闲 > NVIDIA要用上X3D堆叠设计!下代GPU将引入LPU单元 正文
时间:2026-10-02 11:00:36 来源:网络整理 编辑:休闲
虽然NVIDIA目前在AI训练领域无可匹敌,但面对日益增长的即时推理需求,其正筹划一项足以改变行业格局的“秘密武器”。据AGF透露,NVIDIA计划在2028年推出的Feynman(费曼)架构GPU中
虽然NVIDIA目前在AI训练领域无可匹敌,用上引入元但面对日益增长的堆叠U单即时推理需求,其正筹划一项足以改变行业格局的设计“秘密武器”。
据AGF透露,下代NVIDIA计划在2028年推出的用上引入元Feynman(费曼)架构GPU中,整合来自Groq公司的堆叠U单LPU(语言处理单元),以大幅提升AI推理性能。设计
Feynman架构将接替Rubin架构,下代采用台积电最先进的用上引入元A16(1.6nm)制程,为了突破半导体物理限制,堆叠U单NVIDIA计划利用台积电的设计SoIC混合键合技术,将专为推理加速设计的下代LPU单元直接堆叠在GPU之上。

这种设计类似于AMD的堆叠U单3D V-Cache技术,但NVIDIA堆叠的设计不是普通缓存,而是专为推理加速设计的LPU单元。
设计的核心逻辑在于解决SRAM的微缩困境,在1.6nm这种极致工艺下,直接在主芯片集成大量SRAM成本极高且占用空间。
通过堆叠技术,NVIDIA可以将运算核心留在主芯片,而将需要大量面积的SRAM独立成另一层芯片堆叠上去。
台积电的A16制程一大特色是支持背面供电技术,这项技术可以腾出芯片正面的空间,专供垂直信号连接,确保堆叠的LPU能以极低功耗进行高速数据交换。

结合LPU的“确定性”执行逻辑,未来的NVIDIA GPU在处理即时AI响应(如语音对话、实时翻译)时,速度将实现质的飞跃。
不过这也存在两大潜在挑战,分别是散热问题和CUDA兼容性难题,在运算密度极高的GPU 再加盖一层芯片,如何避免“热当机”是工程团队的头号难题。
同时LPU强调“确定性”执行顺序,需要精确的内存配置,而CUDA生态则是基于硬件抽象化设计的,要让这两者完美协同,需要顶级的软件优化。
绿色建筑新宠“Low2026-10-02 10:54
饮料旺季来临,蓝发饮品碳酸饮料重磅来袭,欢迎您的代理!2026-10-02 10:51
什么是寿险?寿险是什么意思?分为哪几种?2026-10-02 10:34
高州市委书记王土瑞:以服务区为核心引擎,探索交农文旅商融合新路径2026-10-02 10:32
张展硕泛太平洋游泳锦标赛200米自由泳摘铜2026-10-02 10:27
“双11”买买买 这些套路不得不防2026-10-02 10:03
贵州华佗四集团中标广西北海市铁山港区项目2026-10-02 09:40
党员先行“聚合力” 打好决算“收官战”2026-10-02 09:06
2018年8月16日中国玻璃综合指数,行业资讯2026-10-02 09:01
母亲节送礼不纠结!Find X9s Pro带队OPPO全家桶超贴心2026-10-02 08:41
返保费的重疾险,返保费的重疾险有现金价值吗2026-10-02 10:55
史上最快!Facebook擠進財星500大企業|天下雜誌2026-10-02 10:52
老新镇快速处置一起散浸险情2026-10-02 10:38
《Barkour》10月2日发布免费试玩 狗子特工动作潜行2026-10-02 09:59
可不可以只买重疾险?买保险只买重疾险可以吗?2026-10-02 09:59
網路行為調查:男人愛現,女人愛分享|天下雜誌2026-10-02 09:51
最大11级!“飑线”突袭厦门送来雷雨大风,刮碎玻璃吹断树枝2026-10-02 09:24
泉州市领导到石狮调研走访挂钩联系企业2026-10-02 08:55
肯德基、蜜雪冰城、瑞幸、高德打车、滴滴等首批接入支付宝AI开放平台2026-10-02 08:53
灾难交易毁掘金季后赛 努尔基奇成开拓者新巨头2026-10-02 08:35