原文跳转提示
此资讯内容来源于外部网站,将在 60 秒后自动跳转到原文页面
https://www.ithome.com/0/993/750.htm
立即前往原文

DeepSeek-V4-PRO 测试:英伟达 Vera Rubin 每兆瓦吞吐量达 GB300 的 30 倍

英伟达使用 SemiAnalysis 的 AgentX 工作负载和 1.6 万亿参数的 DeepSeek-V4-PRO 模型,对 Vera Rubin 进行了评估。公开结果显示,Vera Rubin NVL72 的每兆瓦 Token 吞吐量约为 GB300 NVL72 的 30 倍。该基准测试主要评估智能体编程推理工作负载,指标包括端到端延迟、首个 Token 延迟以及生成阶段性能。测试还显示,GB300 的每兆瓦吞吐量约为 H200 NVL8 的 15 倍,每百万 Token 成本约为上一代的十分之一。英伟达进一步称,Vera Rubin 每百万 Token 的成本约为 GB300 的三十五分之一。上述数字来自所引用的基准测试,尚未经过独立验证。
行业资讯 硬件 行业新闻 科技巨头 AI模型 2026-08-25 15:00:22 977 阅读 阅读约 1 分钟 来源:IT之家
本文来源:IT之家,仅供学习参考,版权归原作者所有。