Google Gemini 4 Argon 缩小与 OpenAI、Anthropic 的差距但未明显领先
Google 发布 Gemini 4 Argon,是其自 Gemini 3.1 Pro 以来首个前沿模型。
Google 发布 Gemini 4 Argon,是其自 Gemini 3.1 Pro 以来首个前沿模型。
谷歌发布 Gemini 4 Argon 旗舰模型,搭载 RSI,在 DeepSWE v1.1(77.4%)、CWE-bench v1(68%)、Vals Index(68.90%)等基准上领先 Claude Opus 5.5 和 GPT-6 Astra,并在 Code Arena 排第八。
推荐理由:文章集中给出 Gemini 4 Argon 与 Opus 5.5、GPT-6 Astra 在 DeepSWE、CWE-bench、Text Arena 等基准上的横向对照和价格差异,读者可据此定位它在前沿模型梯队中的相对位置。
Google DeepMind 公布新一代前沿模型 Gemini 4 Argon,主打编码、企业知识工作(法律、金融)和网络安全防御等长链路任务。
推荐理由:原文同时披露了 Argon 在编码、企业知识工作与网络安全等长链路场景的关键基准成绩与定价,可供与同类前沿模型横向对比。
Google DeepMind 发布两款实时语音对话模型 Gemini 3.8 Live 与 Gemini 3.8 Live Extended Thinking,前者兼顾成本与规模,后者面向高复杂度任务并支持边推理边说话。
推荐理由:原文给出了两款实时语音模型的多项基准成绩和面向开发者、企业的接入入口,读者可以据此对比现有同类方案的能力差异。