AutoSynthData:为智能体生成企业训练数据
ServiceNow CoreAI 构建 AutoSynthData 框架,通过分析目标模型在企业环境</think>
ServiceNow CoreAI 构建 AutoSynthData 框架,通过分析目标模型在企业环境</think>
Amazon Quick Apps 推出 Live Data in Apps 功能,让 AI 构建的应用可在用户打开时实时查询受治理的 Quick Sight 数据集。查询以查看者身份执行,自动套用行级与列级安全规则,SPICE 和 Direct Query 数据集均受支持。构建者用自然语言描述需求,AI 智能体自动发现数据集并生成 SQL,首次使用需获得每数据集的同意。
NVIDIA NeMo Agent Toolkit(NAT)可通过自定义插件将 Amazon S3 Vectors 接入其记忆子系统,作为生产环境的多智能体持久记忆层。
Original title: "The eternal complement" Source: OpenAI News Content。
Claude Platform on AWS(CPonAWS)多环境访问采用专属 AI Services 账户架构,通过 cross-account SigV4、workspace-scoped API key 与 OIDC 联邦三种模式,分别覆盖 AWS 工作负载、开发者本地与外部 CI/CD。
Google DeepMind 公布新一代前沿模型 Gemini 4 Argon,主打编码、企业知识工作(法律、金融)和网络安全防御等长链路任务。
推荐理由:原文同时披露了 Argon 在编码、企业知识工作与网络安全等长链路场景的关键基准成绩与定价,可供与同类前沿模型横向对比。
NVIDIA 研究生奖学金项目即日起开放 2027–2028 学年申请,单项奖金最高 $60,000,面向从事 AI、机器学习、自动驾驶、计算机图形、机器人、医疗及高性能计算相关研究的博士生。申请截止日期为 2026 年 10 月 30 日,候选人须在 2027 年夏季于 NVIDIA 研究办公室完成线下实习。该项目自 2002 年
The article is about Microsoft Research developing a machine learning system for forecasting space-weather risks on power grids. Key facts。
Google DeepMind 发布 SynthID Bio,把水印技术扩展到合成生物学,可在蛋白质序列与预测的 3D 结构中嵌入可验证签名,同时保留生物功能。
OpenAI 打击了一起通过对抗性知识蒸馏窃取其受保护模型推理能力的协调性活动。该攻击专门针对模型核心推理能力进行提取,OpenAI 表示正在加强防御,以防范未来类似的对抗性蒸馏威胁。
OpenAI 与美国小企业发展中心(SBDC)合作,为小企业扩展 AI 实操培训与本地支持服务。同期发布新报告,记录小团队实际使用 AI 的方式。
Google Research 提出 Diffusion Controller 框架,将扩散模型去噪过程重构为连续控制问题,通过一个轻量级"转向阻尼器"附加网络引导生成、保持基础模型冻结不变。其白盒微调版本在 Stable Diffusion v1.4 上对基线模型取得 90% 胜率,并支持对无法修改内部权重的闭源模型进行控制。
NVIDIA 发布开源表格基础模型 Kumo Tabular,在单次前向推理中完成表格分类与回归预测,无需训练或特征工程,权重与代码已在 Hugging Face 和 GitHub 开源。
推荐理由:原文同时给出架构细节与四项表格基准的排名结果,读者可以横向比较它在自身数据规模和列类型下是否值得替换现有方法。
Google DeepMind 在 Gemini 3.8 Live 中推出 Live Avatar 功能,把近实时视频生成与原生语音对话结合,为企业场景提供带口型同步、自然表情和流畅轮换的对话体验。
Google Beam 新增加拿大、英国、法国、德国、日本共 5 个国家,覆盖扩展至 6 个国家,由 18 家渠道合作伙伴交付 HP Dimension 设备。
Google DeepMind 发布 Gemini 3.8 Flash TTS 与 Gemini 3.8 Flash-Lite TTS 两款语音生成模型,支持通过自然语言提示从零创建自定义声音、基于 30 秒样本复制人声,并提供 2000+ 现成声音库与 100+ 语言覆盖。
推荐理由:原文详细列出了两款新 TTS 模型的声音设计、复制与多语言能力,并给出 Hume AI 基准成绩,可对照此前 3.1 Flash TTS 评估实际提升幅度。
Sakeena Fiza 是 NVIDIA 数据中心系统工程实验室的验证工程师,专责在新品量产前以极端条件压测整机系统,曾见证 NVIDIA Rubin GPU 首次在系统级成功点亮。她的工作覆盖固件、硬件、软件、热设计与制造全链路协同,单块板卡含数万个元器件,单机柜接近 50 万颗部件。
Google 宣布扩展 AI & Economy 研究项目,2025 年诺贝尔经济学奖得主 Philippe Aghion 担任学术顾问,多伦多大学教授 Ajay Agrawal 任访问学者,原麦肯锡全球研究院合伙人 Anu Madgavkar 与宾夕法尼亚大学沃顿商学院教授 Daniel Rock 出任项目主任。
Google 的 Envisioning Studio 与时装设计师 Jane Wade 和 Sergio Hudson 合作,在 AI 创意工坊 Google Flow 中共同开发了两款定制工具,分别用于纽约时装周的造型与秀场设计。
联合国系统推出 UN System Data Commons,一个基于 Data Commons by Google 构建的开源 AI 就绪平台,将分散的全球统计数据整合为可搜索的知识图谱。
Pawprint Studio 推出的免费开放世界捉宠 RPG《Aniimo》本周在 GeForce NOW 同步首发,玩家无需下载 45GB 即可跨设备云端体验。同批共 11 款新作上线,《007 First Light》新增路径追踪并搭配 DLSS 4.5 Ray Reconstruction,Ultimate 会员可获 GeForce RTX 5080 级性能与 5K HDR 串流。
Actually the original title structure is "Bypassing inference bottlenecks。
Google DeepMind 发布两款实时语音对话模型 Gemini 3.8 Live 与 Gemini 3.8 Live Extended Thinking,前者兼顾成本与规模,后者面向高复杂度任务并支持边推理边说话。
推荐理由:原文给出了两款实时语音模型的多项基准成绩和面向开发者、企业的接入入口,读者可以据此对比现有同类方案的能力差异。
Google AI Blog 发布"AI for Societal Impact"主题合集,展示 AI 在疾病早筛与治疗、自然灾害预测、教育扩展和经济机会拓展等关键领域的实际应用案例。该合集汇集了全球研究者和社区合作伙伴的项目,展现专家与本地领导者如何借助 AI 突破让更多人共享技术红利。
Google Research 在 ACL 2026 提出的 ToolGrad 采用"答案优先"范式:先生成工具调用链再反推用户查询,借助文本"梯度"迭代构建 API workflow。
GitHub Copilot 应用内置 diff、终端和浏览器三大面板,让用户无需切换应用即可在同一界面完成 AI 代码改动的审查、运行与预览。diff 面板以绿/红色高亮新增与删除行,终端面板可直接运行项目命令,浏览器面板的 Pick & Polish 工具可对页面元素选中后迭代调整。
Mistral 与 Cloudera 宣布建立合作,将 Mistral 模型集成到 Cloudera 混合数据平台,支持企业在私有云、公有云、本地及完全隔离环境中部署 AI 推理,并基于专有数据训练自有模型。
GitHub Copilot app 支持并行运行多个 AI Agent 会话,每个会话独立工作互不干扰。每条会话运行在独立的 Git worktree 上并各自保留上下文,切换时无需重新说明任务。
Google DeepMind 发布 WeatherNext 3 全球天气预报模型,引入实时地球同步卫星观测替代传统 NWP 数据,每小时更新并支持最高 5 公里分辨率。
推荐理由:WeatherNext 3 以实时卫星观测替代 NWP 数据训练,分辨率较前代提升约五倍,中等时效降水精度相对 IMERG 改善最高 60%。
Mistral 与 HUMAIN 宣布战略合作,覆盖沙特及中东地区 AI 基础设施、先进模型开发与行业落地,合作规模达数亿欧元。双方将围绕网络安全和语音等方向开发并本地化先进 AI 模型,并计划打造在阿拉伯语上表现强劲的前沿模型。Mistral 将探索使用 HUMAIN 的数据中心基础设施以满足本地算力需求,双方还将针对受监管行业制定联合市场策略。
The article is about MindTopo, a new benchmark from Microsoft Research for testing topological reasoning in multimodal AI models (VLMs - Vision Language Models). Key points。
Berkeley AI</think>
伯克利 AI Research 发布综述与视角文章,探讨自适应并行推理(Adaptive Parallel Reasoning)作为高效推理扩展的新范式。文章指出当前 Self-consistency、Best-of-N、ParaThinker、GroupThink、Hogwild!
GRASP 是面向世界模型的梯度规划新方法,通过将轨迹提升为虚拟状态以跨时间并行优化、对状态迭代加入随机性以增强探索、并重塑梯度让动作获得清晰信号,解决长horizon规划中梯度条件变差、损失景观充满局部极小等难题。
Berkeley AI Research 提出 SPEX 与 ProxySPEX 算法,用于在大语言模型中以可扩展方式识别驱动模型行为的特征交互。方法借助信号处理与编码理论,基于稀疏性与低阶性假设将指数级搜索重构为可解的稀疏恢复问题;ProxySPEX 进一步利用层级结构,以约 10 倍更少的消融次数达到与 SPEX 相当的性能,可应用于特征归因、数据归因与模型组件归因等可解释性任务。
NeurIPS 2025 论文提出基于互信息的成像系统评估与设计框架,以信息量统一替代分辨率、信噪比等传统指标。方法利用已知噪声物理直接计算噪声熵,用概率模型(如 PixelCNN)估计测量分布,在彩色摄影、射电天文、无透镜成像和显微镜四个领域验证了信息估计对解码器性能的预测能力。
OpenAI 发布开源模型系列 GPT OSS,包含 gpt-oss-120b 和 gpt-oss-20b 两个 MoE 模型,许可证为 Apache 2.0,主打推理与智能体任务。
推荐理由:详细梳理 GPT OSS 在 transformers、vLLM、llama.cpp 等推理框架下的部署配置与微调示例,附带可直接运行的代码片段。
这篇 Hugging Face 博客教程演示如何用 Gradio 的 MCP 集成在 Python 中构建 AI 试穿购物助手,把 IDM-VTON 虚拟试穿模型和 Playwright 网页浏览封装为 LLM 可调用的 MCP 工具。
Hugging Face 发布开源实验追踪 Python 库 Trackio,作为 wandb 的轻量替代品,提供本地 Gradio 仪表盘并支持同步到 Hugging Face Spaces 共享。
Hugging Face 官方博客宣布将命令行工具 huggingface-cli 重命名为 hf,并采用统一的 hf <resource> <action> 命令语法,主要命令包括 auth、download、upload、repo、cache 等。