谷歌Gemini 4 Argon启动定向内测,内部员工质疑代码实战表现
摘要
谷歌已向少数网络安全合作伙伴开放旗舰模型Gemini 4 Argon,称多项基准测试领先。但知情人士透露,员工在实际工作中发现该模型处理代码任务存在困难,内部对其真实能力存疑。
谷歌母公司Alphabet正式启动新一代旗舰人工智能模型Gemini 4 Argon的有限度发布。据彭博社报道,该模型于当地时间周三率先向一小批经过筛选的网络安全合作伙伴开放,谷歌表示将在完成更多测试后逐步扩大范围,优先覆盖付费订阅用户。消息公布后,Alphabet盘后股价一度上涨约1.7%。
从官方口径看,Gemini 4 Argon在多项基准测试中取得靠前排名,其中一项安全能力评测的成绩甚至超过了OpenAI的Astra模型。然而,这些亮眼的数字并未完全打消公司内部的顾虑。多名直接参与该项目的知情人士透露,尽管模型在通用效果基准上表现不俗,但员工在实际工作场景中使用时,体验并不理想,尤其在处理部分代码任务时会遇到明显困难。
这种内外评价的落差并非孤立现象。知情人士还提到,谷歌原本计划在六月份推出另一版本Gemini 3.5 Pro,但最终放弃了该开发工作。这一调整从侧面反映出公司在模型迭代节奏上面临的压力——既要追赶OpenAI和Anthropic,又需确保交付质量经得起实战检验。
针对外界关于Gemini 4在代码等领域表现不佳的说法,谷歌方面已作出回应,但报道中未披露其具体表态内容。随着模型逐步扩大开放范围,其在真实开发与安全场景中的表现,将成为检验谷歌AI竞争力的关键观察窗口。
本文由新大陆基于公开信息编辑整理
信息来源:IT之家 IT之家原文 ↗