谷歌(Google)正研发一款全新人工智能(AI)服务器晶片,计划将Gemini大型语言模型部分功能直接整合至硬件中,以提升AI模型运行效率,并缓解日益严峻的算力需求。

根据外媒引述知情人士报道,这款内部代号为“Frozen v2”的新晶片,预计最快于2028年投入使用。目前工程团队仍在敲定最终设计,以及决定有多少Gemini模型内容将直接写入晶片架构。

报道指出,随着AI服务需求持续攀升,谷歌正面对算力资源紧张的问题,甚至影响Google Cloud向部分企业客户提供服务,因此开发新一代AI晶片成为提升运算能力的重要策略。

据了解,若研发进展顺利,新晶片在单位耗电量下可处理的AI Token数量,效率有望比谷歌现有自研AI晶片提升6至10倍,大幅提高整体运算效能,同时降低能源消耗。

新项目并非取代谷歌现有的张量处理器(TPU),而是建立另一套专门针对AI应用优化的自研晶片体系,以进一步强化公司AI基础设施竞争力。

另外,外媒早前也报道称,由于内部测试结果未达预期,谷歌已延后推出最新版本Gemini AI模型,目前正持续优化其整体性能,特别是程式编写(Coding)能力。

上一则新闻期待柴犬玩成一片 沒想到全員只想各待各的
下一侧新闻被发现时身体僵硬 男子陈尸住家卧室