跳到正文

全部动态

今日 5 条
今天10月2日周五
  1. AWS Machine Learning Blog43

    Amazon Quick Apps 推出 Live Data in Apps,AI 构建应用可实时查询受治理数据集

    Amazon Quick Apps 推出 Live Data in Apps 功能,让 AI 构建的应用可在用户打开时实时查询受治理的 Quick Sight 数据集。查询以查看者身份执行,自动套用行级与列级安全规则,SPICE 和 Direct Query 数据集均受支持。构建者用自然语言描述需求,AI 智能体自动发现数据集并生成 SQL,首次使用需获得每数据集的同意。

10月1日周四
  1. NVIDIA Blog28

    NVIDIA 开放 2027–2028 学年研究生奖学金申请,单项最高 $60,000

    NVIDIA 研究生奖学金项目即日起开放 2027–2028 学年申请,单项奖金最高 $60,000,面向从事 AI、机器学习、自动驾驶、计算机图形、机器人、医疗及高性能计算相关研究的博士生。申请截止日期为 2026 年 10 月 30 日,候选人须在 2027 年夏季于 NVIDIA 研究办公室完成线下实习。该项目自 2002 年

9月30日周三
9月29日周二
  1. Hugging Face Blog69

    NVIDIA 发布开源表格基础模型 Kumo Tabular,覆盖分类与回归

    NVIDIA 发布开源表格基础模型 Kumo Tabular,在单次前向推理中完成表格分类与回归预测,无需训练或特征工程,权重与代码已在 Hugging Face 和 GitHub 开源。

    推荐理由:原文同时给出架构细节与四项表格基准的排名结果,读者可以横向比较它在自身数据规模和列类型下是否值得替换现有方法。

9月25日周五
9月24日周四
9月23日周三
  1. Google DeepMind69

    Google DeepMind 发布 Gemini 3.8 Flash TTS 与 Flash-Lite TTS 语音生成模型

    Google DeepMind 发布 Gemini 3.8 Flash TTS 与 Gemini 3.8 Flash-Lite TTS 两款语音生成模型,支持通过自然语言提示从零创建自定义声音、基于 30 秒样本复制人声,并提供 2000+ 现成声音库与 100+ 语言覆盖。

    推荐理由:原文详细列出了两款新 TTS 模型的声音设计、复制与多语言能力,并给出 Hume AI 基准成绩,可对照此前 3.1 Flash TTS 评估实际提升幅度。

9月18日周五
9月17日周四
9月16日周三
  1. Google DeepMind68

    Google DeepMind 发布 Gemini 3.8 Live 与 3.8 Live Extended Thinking 语音模型

    Google DeepMind 发布两款实时语音对话模型 Gemini 3.8 Live 与 Gemini 3.8 Live Extended Thinking,前者兼顾成本与规模,后者面向高复杂度任务并支持边推理边说话。

    推荐理由:原文给出了两款实时语音模型的多项基准成绩和面向开发者、企业的接入入口,读者可以据此对比现有同类方案的能力差异。

  2. Google AI Blog19

    Google AI:AI 在社会影响中的应用合集

    Google AI Blog 发布"AI for Societal Impact"主题合集,展示 AI 在疾病早筛与治疗、自然灾害预测、教育扩展和经济机会拓展等关键领域的实际应用案例。该合集汇集了全球研究者和社区合作伙伴的项目,展现专家与本地领导者如何借助 AI 突破让更多人共享技术红利。

9月11日周五
9月10日周四
9月4日周五
9月3日周四
8月25日周二
  1. Mistral AI58

    Mistral 与 HUMAIN 达成战略合作,推进沙特和中东主权 AI

    Mistral 与 HUMAIN 宣布战略合作,覆盖沙特及中东地区 AI 基础设施、先进模型开发与行业落地,合作规模达数亿欧元。双方将围绕网络安全和语音等方向开发并本地化先进 AI 模型,并计划打造在阿拉伯语上表现强劲的前沿模型。Mistral 将探索使用 HUMAIN 的数据中心基础设施以满足本地算力需求,双方还将针对受监管行业制定联合市场策略。

8月13日周四
7月26日周日
5月8日周五
4月20日周一
3月13日周五
  1. Berkeley AI Research39

    SPEX 与 ProxySPEX:面向大语言模型的可扩展交互识别方法

    Berkeley AI Research 提出 SPEX 与 ProxySPEX 算法,用于在大语言模型中以可扩展方式识别驱动模型行为的特征交互。方法借助信号处理与编码理论,基于稀疏性与低阶性假设将指数级搜索重构为可解的稀疏恢复问题;ProxySPEX 进一步利用层级结构,以约 10 倍更少的消融次数达到与 SPEX 相当的性能,可应用于特征归因、数据归因与模型组件归因等可解释性任务。

1月10日周六
  1. Berkeley AI Research44

    基于信息驱动的成像系统设计

    NeurIPS 2025 论文提出基于互信息的成像系统评估与设计框架,以信息量统一替代分辨率、信噪比等传统指标。方法利用已知噪声物理直接计算噪声熵,用概率模型(如 PixelCNN)估计测量分布,在彩色摄影、射电天文、无透镜成像和显微镜四个领域验证了信息估计对解码器性能的预测能力。

8月5日周二
7月31日周四
7月29日周二
7月25日周五