据外媒援引多位消息人士报道,谷歌正在开发一款专为自家人工智能模型“Gemini”优化的定制半导体。该芯片内部代号为“Frozen v2”,目标于2028年投入服务器部署。
“Frozen v2”与通用TPU的区别
“Frozen v2”与谷歌此前开发并推出的张量处理器(TPU)是独立并行的项目。现有的TPU与英伟达的GPU类似,具备处理多种AI模型的通用性;而“Frozen v2”则是将Gemini的数据处理方式及部分底层架构预先内置到芯片中。据悉,这一构想由谷歌首席科学家杰夫·迪恩(Jeff Dean)提出,“Frozen(冻结)”的命名正是源于将芯片结构与Gemini模型相匹配并固定的理念。
效率提升与算力瓶颈
谷歌预计,若使用“Frozen v2”运行Gemini,在同等功耗下可处理的Token数量将提升6至10倍,同时响应速度也将大幅加快。目前,为了在灵活性和效率之间取得平衡,谷歌仍在评估向“Frozen v2”中预置多少信息。
谷歌此举的背景在于AI算力资源的严重短缺。随着AI模型开发与服务运营所需的算力需求激增,谷歌内部已出现算力资源分配的冲突,甚至导致部分外部客户的合作受到限制。事实上,谷歌近期已与埃隆·马斯克旗下的xAI达成协议,每月支付9.2亿美元租赁数据中心;同时,也限制了Meta对自家AI模型的使用量。
量产前景与官方回应
据悉,谷歌并没有大规模量产“Frozen v2”的计划。这是因为即便是Gemini系列,不同版本的模型结构和参数(权重)也可能发生变化,一旦底层架构改变,该专用芯片的适用性将大幅降低。
针对此事,谷歌发言人发表声明称:“为了向用户和客户提供最大的性能和效率,我们正在持续研究和实验新的创新技术。”

