谷歌计划冻结 v2 AI 芯片以嵌入 Gemini 架构,到 2028 年或可将推理效率提升 6-10 倍

据 Beating 称,Google 正在开发 Frozen v2 AI 推理芯片。该芯片将把 Gemini 的部分架构直接嵌入硬件中,以在模型执行期间降低计算与数据传输开销。该芯片预计“每瓦特”处理的 token 数将比 Google 最新的 TPU 高 6 到 10 倍,并计划最早于 2028 年部署。

该举措旨在应对 Google 日益加剧的芯片短缺问题;短缺已迫使 Google Cloud 拒绝外部客户订单。Frozen v2 将与 TPU 并行运行。尽管 TPU 支持多种模型,Frozen v2 更强调效率而非灵活性。

免责声明:本页面信息可能来自第三方,仅供参考,不代表 Gate 的观点或意见,亦不构成任何财务、投资或法律建议。数字资产交易风险较高,请勿仅依赖本页面信息作出决策。具体内容详见声明
评论
0/400
暂无评论