据鼓狮财经10月1日报道,谷歌正式推出了备受瞩目的旗舰人工智能模型Gemini 4 Argon。然而,公司内部对于该模型在编程等关键领域的实际表现提出了质疑。
本周三,谷歌仅向一小批可信赖的网络安全合作伙伴开放了该模型的测试权限。公司表示,将在进行更多测试后扩大使用范围,首先对付费用户开放。谷歌方面宣称,Gemini 4在多项基准测试中均取得了领先成绩,包括在一项衡量安全能力的测试中击败了OpenAI的Astra模型。
不过,部分知情人士指出,这些测试指标并不能完全反映模型的实际效能。据了解该项目的知情人士透露,尽管Gemini 4在基准测试中表现出色,但在员工的实际使用过程中,其效果并未达到预期,某些编程任务的表现尤其不尽如人意。
