英伟达 CEO 披露 GPT-6 Astra 训练使用 10 万张 Blackwell GPU

By: www.theblockbeats.info|2026/09/07 07:08:58

英伟达 CEO 黄仁勋披露,GPT-6 Astra 训练使用了约 10 万张以上 Grace Blackwell GPU,通过 NVLink72 组成高速互联集群。下一批将上线 40 万张 GPU,但未说明具体型号。中国头部模型公司在算力上仍有明显差距,字节目前最接近,接入约 3.6 万张 B200。字节在中国境内集群主要使用 Hopper 架构的 H20 和 H800。Kimi 通过阿里获得约 2 万张 Hopper GPU,具体型号为 H200,但阿里否认该说法。H200 属于上一代 Hopper,B200 已升级到 Blackwell。GB200 结合了 Grace CPU 和 Blackwell GPU,NVL72 可将 72 张 GPU 放入同一高速互联域。DeepSeek 没有公布 V4 的完整训练硬件,流出信息称公司 5 月有约 2 万张 H 等效算力,华为提供的 950 产能约 1.6 万张。梁文锋称这批国产卡相当于 4000 张 Nvidia B 系列,足够当前一代模型训练。Astra 使用的 Blackwell 也不是 Nvidia 最新一代,Vera Rubin 已进入全面量产,NVIDIA 估算 Rubin 训练大型 MoE 模型所需 GPU 数量可降到 Blackwell 的四分之一。目前没有中国公司披露过 10 万张同代先进 GPU 用于一次模型训练的案例,显示中美 AI 公司在卡的数量和代际上的差距。

-- 价格

--
--
--

本内容仅供参考,不构成任何金融、投资、法律或税务建议。文中提及的任何活动、奖励、线上活动或相关信息,不应被视为对购买、出售或交易任何加密资产的推荐、招揽或邀请。加密资产具有高波动性,存在价值损失风险。WEEX服务、产品及相关活动的可用性可能因地区而异。用户在参与前有责任确保符合当地适用法律法规。

猜你喜欢

iconiconiconiconiconicon
客户服务:@weikecs
商务合作:@weikecs
量化做市商合作:bd@weex.com