Google Gemini 4 Argon 缩小与 OpenAI、Anthropic 的差距但未明显领先
Google 发布 Gemini 4 Argon,是其自 Gemini 3.1 Pro 以来首个前沿模型。
Google 发布 Gemini 4 Argon,是其自 Gemini 3.1 Pro 以来首个前沿模型。
谷歌发布 Gemini 4 Argon 旗舰模型,搭载 RSI,在 DeepSWE v1.1(77.4%)、CWE-bench v1(68%)、Vals Index(68.90%)等基准上领先 Claude Opus 5.5 和 GPT-6 Astra,并在 Code Arena 排第八。
推荐理由:文章集中给出 Gemini 4 Argon 与 Opus 5.5、GPT-6 Astra 在 DeepSWE、CWE-bench、Text Arena 等基准上的横向对照和价格差异,读者可据此定位它在前沿模型梯队中的相对位置。
Google 发布新一代前沿模型 Gemini 4 Argon,声称在真实软件工程、法律和金融等企业知识工作以及网络安全防御上达到前沿水平,初期仅向一组"可信网络防御者"开放。
Google 发布 Gemini 4 Argon 模型,声称在编码、知识工作和网络安全上达到行业领先水平,但目前仅在 Google 内部有限测试,尚未对公众开放。
Google DeepMind 公布新一代前沿模型 Gemini 4 Argon,主打编码、企业知识工作(法律、金融)和网络安全防御等长链路任务。
推荐理由:原文同时披露了 Argon 在编码、企业知识工作与网络安全等长链路场景的关键基准成绩与定价,可供与同类前沿模型横向对比。
Google DeepMind 发布 Gemini 3.8 Flash TTS 与 Gemini 3.8 Flash-Lite TTS 两款语音生成模型,支持通过自然语言提示从零创建自定义声音、基于 30 秒样本复制人声,并提供 2000+ 现成声音库与 100+ 语言覆盖。
推荐理由:原文详细列出了两款新 TTS 模型的声音设计、复制与多语言能力,并给出 Hume AI 基准成绩,可对照此前 3.1 Flash TTS 评估实际提升幅度。
Google DeepMind 发布两款实时语音对话模型 Gemini 3.8 Live 与 Gemini 3.8 Live Extended Thinking,前者兼顾成本与规模,后者面向高复杂度任务并支持边推理边说话。
推荐理由:原文给出了两款实时语音模型的多项基准成绩和面向开发者、企业的接入入口,读者可以据此对比现有同类方案的能力差异。
Google DeepMind 发布 WeatherNext 3 全球天气预报模型,引入实时地球同步卫星观测替代传统 NWP 数据,每小时更新并支持最高 5 公里分辨率。
推荐理由:WeatherNext 3 以实时卫星观测替代 NWP 数据训练,分辨率较前代提升约五倍,中等时效降水精度相对 IMERG 改善最高 60%。
Nano Banana 2(Gemini 3.1 Flash Image)是 Google DeepMind 发布的最新图像生成模型,将 Pro 级能力与 Flash 速度结合。
推荐理由:Nano Banana 2 把 Pro 级能力下放到 Flash 速度,读者可对比 Pro 与 2 的能力侧重,挑选适合自己工作流的版本。