发现者网
产业经济 科技业界 3C数码 文化传媒 移动智能 家电行业 AI大模型 汽车出行 热点资讯

英伟达Rubin GPU架构揭秘:3nm工艺加持,智能体AI性能飙升10倍

2026-07-23来源:快讯编辑:瑞雪

英伟达正式公布了其下一代GPU架构Rubin的详细信息,这款基于台积电3nm(N3P)工艺制造的芯片在性能和能效方面实现了重大突破。Rubin GPU通过双Die封装设计,集成多达3360亿个晶体管,较前代Blackwell GB300芯片增加62%,同时将智能体AI工作负载的单位能耗吞吐量提升至10倍。

架构设计上,Rubin采用双Die封装方案,每个Die集成4个图形处理集群(GPC),通过NVIDIA高带宽接口(NV-HBI)实现统一管理。全芯片共包含8个GPC,其中4个配备30个流式多处理器(SM),另4个配备26个SM,总计224个SM和896个Tensor Cores。每个Die还配置了两组去中心化L2缓存、Gigathread引擎、4个HBM通道(单通道4096位)及NVLink接口,形成高效计算单元。

在互联性能方面,Rubin支持多层级带宽配置:NVLink 6提供3600 GB/s的GPU间互联带宽,NVLink-C2C接口实现1800 GB/s的CPU至GPU通信带宽,PCIe Gen6 x16通道则提供256 GB/s的主机连接能力。这种设计使芯片在复杂计算场景中具备更强的数据吞吐能力。

内存系统是Rubin的核心升级点之一。该架构搭载8个12层堆叠的HBM4内存模块,总容量达288GB,单堆栈容量36GB,峰值带宽提升至22 TB/s,较Blackwell的8 TB/s提升1.8倍。这种配置不仅支持更大规模的模型训练,还能在生成式AI的逐令牌处理阶段保持模型权重与KV状态的高速传输,显著提升推理效率。

性能跃升得益于三大架构创新:增强型张量核心支持扩展精度计算,第三代Transformer引擎优化了注意力机制处理,全新HBM4内存子系统则突破了数据传输瓶颈。这些改进使Rubin在处理智能体AI等复杂任务时,既能保持低功耗运行,又能实现指数级性能提升,为大规模AI部署提供了硬件基础。

具身智能新路径:通用技术底座助力机器人从“炫技”到“实干”
启智的答案是:不一定非得是“人形”,不一定非得是单台“明星产品”,但一定需要一套能让各种形态的机器人都“学会干活”的底层系统。 正如肖永强所言:“启智核心做的是构建一个架构,让更多行业内的企业、做模型的企业、…

2026-07-23

苹果Apple Park游客中心升级改造进行时,AR展览区关闭但多区域仍可体验
IT之家 7 月 22 日消息,苹果官网最新发布的一则公告显示,美国加州库比蒂诺(Cupertino)的 Apple Park游客中心(Apple Park Visitor Center)正在进行升级改造。…

2026-07-23

国内首套智能体全生命周期互联标准发布 为AI跨域协作筑牢根基
本次发布的 GB/Z185-2026 系列标准完整规范总体架构、智能体身份码、身份管理、能力描述、跨域发现、协同交互、工具调用七大核心环节,破解长期以来不同厂商智能体互不兼容、身份可信缺失、跨域协作壁垒突出等…

2026-07-23

美AI失控上演“终结者”预演?关键时刻中国AI出手力挽狂澜
美国开放人工智能研究中心(OpenAI)21日承认,该公司的GPT-5.6Sol模型和另一款能力更强的预发布模型联合进行内部评估时失控,突破隔离测试环境,侵入了人工智能开源平台美国抱抱脸公司的系统。 根据…

2026-07-23

国内首套智能体全生命周期互联标准发布,2000余个智能体获“数字身份证”
本次发布的 GB/Z185-2026 系列标准完整规范总体架构、智能体身份码、身份管理、能力描述、跨域发现、协同交互、工具调用七大核心环节,破解长期以来不同厂商智能体互不兼容、身份可信缺失、跨域协作壁垒突出等…

2026-07-23

熹乐软件弹幕上墙技术解析:多场景适配,高效稳定保障活动体验
系统可对文字、图片等弹幕内容进行实时扫描,用户反馈表明,其智能校验功能使合规通过率提升20 - 50%,有效避免违规内容上墙。 在一场千人规模的大型会议中,使用熹乐软件的弹幕上墙功能,现场网络波动较大,但凭借…

2026-07-23