跳到正文

全部动态

今日 7 条
9月5日周六
  1. GitHub Blog · AI & ML65

    GitHub Copilot 发布 Project HydraFusion 研究预览,通过多模型编排提升编码任务质量

    GitHub 推出 Project HydraFusion 研究预览,已在 GitHub Copilot CLI 中通过 /experimental 向所有 Copilot 套餐开放,按底层模型标准 token 费率计费。

    推荐理由:给出了多模型运行时编排的实现细节与三项智能体编码基准的成本与质量对比,可作为评估运行时调度思路取舍的参照。

9月4日周五
9月3日周四
9月2日周三
  1. Google DeepMind68

    Gemini 推出 agentic 视频理解功能,最多可减少 88% token 消耗

    Google DeepMind 在 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 中上线 agentic 视频理解功能,可将 token 消耗降低最多 88%、成本降低最多 66%,分析精度最高提升 7%。

    推荐理由:对比传统固定帧率处理方式,原文给出 token 消耗与精度的具体改进幅度,可作为评估新视频管线效果的参考。

8月26日周三
8月25日周二
  1. Mistral AI58

    Mistral 与 HUMAIN 达成战略合作,推进沙特和中东主权 AI

    Mistral 与 HUMAIN 宣布战略合作,覆盖沙特及中东地区 AI 基础设施、先进模型开发与行业落地,合作规模达数亿欧元。双方将围绕网络安全和语音等方向开发并本地化先进 AI 模型,并计划打造在阿拉伯语上表现强劲的前沿模型。Mistral 将探索使用 HUMAIN 的数据中心基础设施以满足本地算力需求,双方还将针对受监管行业制定联合市场策略。

8月13日周四
7月26日周日
7月21日周二
7月8日周三
7月7日周二
  1. Hugging Face Blog65

    Hugging Face 开放权重模型集合上线 Microsoft Foundry Managed Compute

    Hugging Face 与 Microsoft 在 Microsoft Build 2026 上联合推出 Foundry 上的 Hugging Face 模型集合,把开放权重模型以每周刷新的策展目录接入 Foundry Managed Compute,可一键部署到 NVIDIA A100、H100 与 AMD MI300X 加速器。

    推荐理由:原文详述了从社区筛选、许可证审核、运行时签名到一键部署的完整流水线,方便评估将开放权重模型搬上 Azure 的工程代价。

7月1日周三
5月8日周五
4月23日周四
4月20日周一
3月13日周五
  1. Berkeley AI Research39

    SPEX 与 ProxySPEX:面向大语言模型的可扩展交互识别方法

    Berkeley AI Research 提出 SPEX 与 ProxySPEX 算法,用于在大语言模型中以可扩展方式识别驱动模型行为的特征交互。方法借助信号处理与编码理论,基于稀疏性与低阶性假设将指数级搜索重构为可解的稀疏恢复问题;ProxySPEX 进一步利用层级结构,以约 10 倍更少的消融次数达到与 SPEX 相当的性能,可应用于特征归因、数据归因与模型组件归因等可解释性任务。

3月9日周一
  1. Google DeepMind42

    从游戏到生物学:AlphaGo 十年来的影响

    Demis Hassabis 回顾 AlphaGo 2016 年以"第 37 手"击败围棋世界冠军李世石十周年,称这一突破开启了现代 AI 时代。其后 AlphaFold 预测了 2 亿个蛋白质结构并于 2024 年获诺贝尔化学奖,全球超 300 万研究者在使用;AlphaProof 和 Gemini Deep Think 先后在 IMO 取得银牌和金牌。

2月27日周五
2月19日周四
2月18日周三
2月17日周二
1月30日周五
  1. Google DeepMind53

    Google DeepMind 上线 Project Genie 可交互世界实验原型

    Google DeepMind 上线 Project Genie 实验原型,基于 Genie 3 世界模型构建,面向 18 岁以上美国 Google AI Ultra 订阅者开放。该 Web 应用由 Genie 3、Nano Banana Pro 与 Gemini 共同驱动,支持通过文字与图像提示创建可实时生成路径的可探索世界,并可在已有世界基础上进行二次创作,单次生成时长上限 60 秒。

1月23日周五
  1. Google Research38

    Google Research:通过分解式两阶段流程让小模型在设备端实现比肩大模型的用户意图提取

    Google Research 在 EMNLP 2025 发表的论文提出分解式两阶段流程,先逐屏总结用户操作,再从屏幕摘要序列中提取意图,让小型多模态大语言模型可在设备端完成用户意图理解。该方法在移动端和网页轨迹上均优于 CoT 提示与端到端微调;其中 Gemini 1.5 Flash 8B 配合分解流程即可达到与 Gemini 1.5 Pro 相当的 F1 分数,同时显著降低成本与延迟。

1月21日周三
1月18日周日
1月15日周四
1月14日周三
1月13日周二
  1. Google Research46

    NeuralGCM 利用 AI 更好地模拟长程全球降水

    NeuralGCM 在 Science Advances 发表新版论文,直接以 NASA 2001–2018 年卫星降水观测训练混合 AI-物理模型,在 15 天天气预报与多年代气候模拟上均优于传统物理模型。相比 IPCC 报告所用领先工具,平均误差降低 40%,对最强 0.1% 极端降水及日变化周期改进尤为显著。

1月10日周六
  1. Berkeley AI Research44

    基于信息驱动的成像系统设计

    NeurIPS 2025 论文提出基于互信息的成像系统评估与设计框架,以信息量统一替代分辨率、信噪比等传统指标。方法利用已知噪声物理直接计算噪声熵,用概率模型(如 PixelCNN)估计测量分布,在彩色摄影、射电天文、无透镜成像和显微镜四个领域验证了信息估计对解码器性能的预测能力。

1月9日周五
1月8日周四
1月7日周三
1月2日周五