英伟达4600颗GB300部署Azure,单卡288GB显存+37TB内存池

英伟达4600颗GB300部署Azure,单卡288GB显存+37TB内存池

6月30日,Anthropic旗下Claude AI模型在微软Azure平台正式全面可用,底层由英伟达最强Blackwell Ultra GB300系列GPU提供算力支撑。此次部署标志着微软、英伟达与Anthropic三方于2025年11月宣布的战略合作,从框架协议正式进入商用交付阶段。

Azure已部署全球首个大规模生产级GB300 NVL72集群,集成超过4600颗Blackwell Ultra GPU。72颗GPU与36颗Grace CPU通过NVLink-C2C高速互联组成统一机架,共享37TB快速内存池。单颗GPU搭载288GB HBM3e高带宽显存,NVLink带宽达130TB/s,FP4张量核心性能最高达1440 PFlops。

GB300 NVL72配备Quantum-X800 InfiniBand网络,相比前代GB200 NVL72,AI性能提升1.5倍,AI工厂收入机会较Hopper架构系统增加50倍。万亿参数模型实时推理速度提升达30倍,DeepSeek-R1推理吞吐量相比GB200 NVL72提升45%,用户响应速度相比Hopper架构提升10倍,每兆瓦吞吐量提升5倍。

首批上线Claude Opus 4.8与Haiku 4两款模型,Anthropic表示将持续在Azure扩展部署。企业可通过英伟达认证的智能体技能为Claude赋予特定业务能力。英伟达安全代理工作区参考设计已在基础设施层面控制身份、网络访问、凭证和运行时策略,满足金融、医疗、法律等高合规要求行业的需求。

对英伟达而言,此次部署验证了Blackwell Ultra GB300作为企业推理平台的价值。微软则获得Claude在Azure的独家企业分销渠道,强化了对AWS和谷歌云的竞争地位

f6eae61b29ced680c6c737567a4dc87b271409e6f75b81bacaf441137c40ff5c.0

© 版权声明
THE END
喜欢就支持一下吧
点赞15赞赏 分享
评论 抢沙发

请登录后发表评论

    暂无评论内容