谷歌研发新一代AI芯片,旨在全面提升Gemini运行效率

据 TechCrunch 报道,谷歌母公司 Alphabet 正在研发一款全新的专用 AI 芯片,旨在显著提升其 Gemini 系列大模型的运行效率。随着大模型参数量的持续增长,推理成本与能耗已成为制约 AI 应用规模化部署的核心瓶颈。谷歌此前已推出 TPU(张量处理单元)系列芯片,但面对 Gemini 这种超大规模多模态模型对算力的极高要求,公司正寻求通过更深层的硬件定制来降低延迟并优化功耗。

业内分析认为,这款新芯片可能会在内存带宽、专用指令集或算子加速方面进行针对性优化,以减少模型在处理复杂任务时的资源占用。此举不仅有助于降低谷歌在云端运行 Gemini 的运营成本,还将使其在与 OpenAI 和微软的算力军备竞赛中进一步降低对第三方芯片供应商(如英伟达)的依赖,从而构建起从底层硬件到顶层模型的全栈垂直整合优势。

来源: TechCrunch

类似文章

发表回复