根据 Nvidia 最新博客分析,Blackwell GPU 的每小时成本几乎是 Hopper 代际的两倍,但每个 token 的推理成本却低 35 倍。以 DeepSeek-R1 作为测试模型,Blackwell(GB300 NVL72)按每 GPU 每小时 2.65 美元出租,而 Hopper 为 1.41 美元;但单个 GPU 的吞吐量从 90 跃升至 6,000 每秒 token。这样 65 倍的吞吐量增益使每百万 token 成本从 4.20 美元降至 0.12 美元。
0.12 美元这一数值假设完成了全套软件优化,包括 FP4 低精度推理和多 token 预测(MTP)。如果未启用 MTP,每百万 token 成本约为 2.35 美元,启用后降至 0.11 美元,表明仅该特性就带来了 21 倍的优化效果。
免责声明:本页面信息可能来自第三方,不代表 Gate 的观点或意见。页面显示的内容仅供参考,不构成任何财务、投资或法律建议。Gate 对信息的准确性、完整性不作保证,对因使用本信息而产生的任何损失不承担责任。虚拟资产投资属高风险行为,价格波动剧烈,您可能损失全部投资本金。请充分了解相关风险,并根据自身财务状况和风险承受能力谨慎决策。具体内容详见
声明。
相关文章
R0AR 进入 Consensus 2026 PitchFest 决赛轮,勉强错失前 20 名
根据 MetaversePost,R0AR 于 5 月 4 日晋级 CoinDesk 2026 PitchFest 的最终遴选轮,险些错过入选现场路演的前 20 家初创企业。这位 Web3 和 AI 创新者与全球其他高潜力初创企业一同接受评估,位于行业的其中一个 m
GateNews3小时前
马斯克在开庭前寻求向 OpenAI 达成 1500 亿美元和解,和解谈判失败
根据一份法院文件,埃隆·马斯克于 4 月 26 日联系了 OpenAI 总裁 Greg Brockman——在他们于奥克兰联邦法院开庭的前两天——以探讨和解。 当 Brockman 建议双方都放弃各自的主张时,马斯克以威胁回应,告诉 Brockman:“到年底
GateNews3小时前
Cursor 接受 SpaceX 的 600 亿美元收购要约,但不会与 xAI 在编码模型方面合作
据 The Information 称,Cursor 已接受来自 SpaceX 的一项附条件 600 亿美元收购要约,尽管该交易尚未最终敲定。该公司目前没有计划与 SpaceX 的 AI 部门 xAI 合作开发编码模型。相反,Cursor 正在专注于对其进行优化
GateNews3小时前
Haun Ventures 在 5 月 4 日关闭 10 亿美元基金,在早期与后期加密投资之间分配资本
据 Bloomberg 称,Haun Ventures 于 5 月 4 日完成了一轮 10 亿美元的融资,其中 5 亿美元用于早期投资,5 亿美元用于后期投资。该基金将在未来两到三年内部署资金,面向加密货币和区块链初创企业,同时扩展
GateNews3小时前
OpenAI 为部署合资企业筹集 $4 十亿,估值 100 亿美元
据 BlockBeats 称,在 5 月 4 日,OpenAI 融资超 $4 billion(应按规模词转换为中文“亿/万亿”等表达),以设立一家新的合资企业,专注于帮助企业采用其人工智能软件。该企业名为 The Deployment Company,由包括 TPG Inc.、Brookfield Asset Management 在内的 19 家投资者支持,
GateNews5小时前
为什么有人觉得 AI 改变世界、有人觉得普通?Karpathy 的两个诊断
Karpathy 指出,AI 认知差距源自两个诊断:1)只用过免费/旧版模型,无法反映最先进 agentic 模型的实力;2)能力提升在高度技术领域才显著,且呈现不对称。这使付费用户与一般读者各看见不同现象,形成平行世界的互相误解。给台湾读者的启示是,实际使用最先进模型完成生产任务、检核判断依据,才能避免被媒体迷思左右。
鏈新聞abmedia5小时前