谷歌推出的旗舰AI模型实战性能遭员工质疑

谷歌公司已开始逐步推出外界期待已久的旗舰人工智能模型Gemini 4 Argon,但公司内部对于该模型在编程等关键领域的表现仍存在质疑。谷歌周三向一小批值得信赖的网络安全合作伙伴率先开放了该模型。谷歌公司表示,Gemini 4在多项基准测试中取得领先成绩,其中包括在一项衡量网络安全能力的测试中击败了OpenAI的Astra模型。

但是,一些内部人士表示,这些指标并不能说明全部情况。据直接了解相关工作的知情人士称,尽管Gemini 4在广泛用于衡量模型效能的基准测试中表现良好,但当员工真正将其投入实际工作时,它的表现就不那么理想了。该模型难以处理某些编程任务。

—— 凤凰网科技、彭博社
 
 
Back to Top