跳到正文

模型发布

新模型的发布、开源与迭代:大模型厂商的旗舰更新、开源权重放出、性能与价格变化的第一时间记录。

最新精选

第 21–30 条 · 共 30 条
9月23日周三
  1. OpenAI News76

    OpenAI 发布 GPT-6 Sol 与 GPT-6 Luna,API 价格较 GPT-5.6 下调 50%

    OpenAI 发布 GPT-6 家族的 GPT-6 Sol 与 GPT-6 Luna,API 定价较 GPT-5.6 促销价下调 50%,分别为 $2/$10 与 $0.10/$0.50(每百万 token)。

    推荐理由:原文把 GPT-6 Sol 和 Luna 的 API 定价、缓存折扣以及在 AutomationBench、DeepSWE 等基准上与 Claude Opus 5、Fable 5.1 的成本-得分一并列出,便于同价位横向对照。

9月16日周三
9月3日周四
9月1日周二
  1. Google Research64

    TimesFM-3:Google Research发布支持多变量零样本预测的时序基础模型

    Google Research发布时序基础模型TimesFM-3,首次原生支持多变量零样本预测。模型拥有3.3亿参数,在超过1万亿时间点的真实与合成数据上预训练。

    推荐理由:对比了TimesFM-3与Chronos-2、Toto 2.0等模型在Gift-Eval等基准上的排名,读者可据此了解多变量时序基础模型的当前能力。

8月28日周五
  1. Google DeepMind69

    Google DeepMind 发布 Gemini Omni 1.1 Flash 带来场景延长、首尾帧插值与 4K 放大

    Google DeepMind 推出 Gemini Omni 1.1 Flash,新增场景延长、首尾帧插值、4K 放大和视频参考等视频生成控制能力。场景延长可参考最多 10 秒上文,单次累计上限 40 秒;360p 预览生成速度比 720p 快 60%,成本降至三分之一。

    推荐理由:原文列出了 Omni 1.1 Flash 在场景延长、首尾帧插值和 4K 放大等具体控制能力上的更新,可帮助开发者判断它能接入哪些视频生产工作流。

8月27日周四
  1. Google DeepMind70

    Google DeepMind 发布 Gemini 3.5 Transcribe 语音转文本模型

    Google DeepMind 发布语音转文本模型 Gemini 3.5 Transcribe,主打实时转写与智能语音交互,提供实时流式(Live API)和预录音频(Interactions API)两种接入方式。

    推荐理由:给出了 WER、延迟改善幅度和多语言覆盖等具体基准,并区分了实时与预录两种接入方式,便于评估在语音产品中的替换价值。

8月25日周二
8月10日周一
  1. Hugging Face Blog74

    Meta 开源 30B 多模态模型 Muse Glimmer,主打本地智能体场景

    Meta 发布并开源 30B 多模态模型 Muse Glimmer(Apache 2.0),由 Muse 蒸馏而来,主打本地智能体场景,由 Hugging Face 在发布当日同步接入 transformers、llama.cpp、vLLM 与 Inference Endpoints,并支持基于 DFlash 的推测解码加速。

    推荐理由:原文汇总 30B 多模态模型的关键基准、DFlash 加速与同日多框架支持,便于评估其在本地智能体工作流中的可用性。

8月6日周四
  1. Google DeepMind68

    Google DeepMind 开源 WeatherNext 2 与 WeatherNext Cyclones,气旋预报提前量提升超一天

    Google DeepMind 在 Nature 论文中宣布其 WeatherNext AI 模型在气旋路径、强度和风结构预报上取得 state-of-the-art 准确度,其三天预报质量相当于此前模型的两天预报,平均带来超过 24 小时的预报提前量,约等于过去二十年气象领域的十年进步。

    推荐理由:WeatherNext Cyclones 把气旋路径和强度的预报提前量提升超过一天,并已开源代码与权重,可被气象机构直接用于业务预报。