PANews 10月1日消息,谷歌已開始推出備受期待的旗艦人工智能模型Gemini 4 Argon,但公司內部對於該模型在編程等關鍵領域的實際表現存在質疑。週三,谷歌向一小批可信賴的網絡安全合作夥伴開放了該模型,並表示將在進行更多測試後擴大使用範圍,首先對付費用戶開放。Gemini 4在多項基準測試中取得了領先成績,包括在一項衡量安全能力的測試中擊敗了OpenAI的Astra模型。
不過,一些內部人士表示,這些指標並不能反映全貌。據直接了解這項工作的知情人士稱,儘管Gemini 4在衡量模型效能的基準測試中表現出色,但在員工實際使用時,效果則沒有那麼出色,某些編程任務尤其如此。

