谷歌终于推出旗舰AI模型 但实战性能却遭员工质疑

谷歌终于推出旗舰AI模型 但实战性能却遭员工质疑

谷歌Gemini

谷歌Gemini

凤凰网科技讯 北京时间10月1日,据彭博社报道,谷歌公司已开始逐步推出外界期待已久的旗舰AI模型Gemini 4 Argon,但公司内部对于该模型在编程等关键领域的表现仍存在质疑。

谷歌周三向一小批值得信赖的网络安全合作伙伴率先开放了该模型,并表示在进一步测试后扩大开放范围,首先面向付费订阅用户。谷歌表示,Gemini 4在多项基准测试中取得领先成绩,其中包括在一项衡量网络安全能力的测试中击败了OpenAI的Astra模型。

但是,一些内部人士表示,这些指标并不能说明全部情况。据直接了解相关工作的知情人士称,尽管Gemini 4在广泛用于衡量模型效能的基准测试中表现良好,但当员工真正将其投入实际工作时,它的表现就不那么理想了。他们说,该模型难以处理某些编程任务。

在谷歌发布Gemini 4 Argon后,其母公司Alphabet股价在盘后交易中上涨约1.7%。在周三常规交易时段尾段,在彭博社报道称公司员工对该模型存在质疑后,Alphabet股价回吐了此前的涨幅。

谷歌近期一直在努力开发能够与OpenAI和Anthropic竞争的模型。据知情人士透露,公司原计划在6月发布另一个版本,名为Gemini 3.5 Pro,但后来放弃了这一计划。

谷歌表示,有关Gemini 4在编程等领域表现不佳的说法并不准确。该公司让彭博社参考谷歌DeepMind负责人科拉伊·卡武克丘格鲁(Koray Kavukcuoglu)上周发表的言论。卡武克丘格鲁当时表示,他对该模型的表现感到鼓舞。

“我对团队抱有最大的信任,”卡武克丘格鲁在科技新闻网站The Information主办的一场会议上说,“在我看来,我们始终处于前沿位置,这是确定无疑的。”

谷歌内部对此存在不同看法。一些员工认为,Anthropic的Fable和OpenAI的Astra模型进步速度快于Gemini。他们认为,即使发挥出最佳水平,Gemini 4在某些领域仍将落后于这些模型。另一些员工则认为,即将推出的这个版本已经追上了领先的AI实验室。

一名熟悉模型开发的谷歌员工表示,Gemini 4处于前沿水平是公司内部的“普遍共识”。这名人士称,公司已对这些模型进行了严格测试,并否认它们在杂乱、真实的编程任务中表现不佳。

谷歌迫切需要Gemini 4取得成功。该模型的不同版本支撑着公司几乎所有的产品,从作为谷歌主要利润来源的搜索引擎顶部的AI回答,到地图、Gmail和Chrome。这些产品的用户数都超过10亿,这是谷歌一些竞争对手所不具备的分发优势。

但OpenAI和Anthropic正越来越多地从销售模型转向自主开发产品,包括编程智能体。如果谷歌无法推出一款处于行业前沿的模型,其竞争对手就会获得更多时间来说服消费者、开发者和企业,让他们相信未来的搜索和软件应该运行在它们的平台上。

针对彭博社的提问,谷歌表示,尽管其上一款Pro模型是在2月发布,但此后公司的AI产品仍实现了增长,包括面向企业的Gemini,以及面向消费者的聊天机器人应用和谷歌搜索中的AI模式。其中,后两项产品的用户数均已超过10亿。(作者/箫雨)

更多一手新闻,欢迎下载凤凰新闻客户端订阅凤凰网科技。想看深度报道,请微信搜索“凤凰网科技”。