AI 日报 · 2026 年 10 月 4 日 · 星期日
AI日报
Anthropic 发布 Claude Sonnet 5.5,官方称速度提升 30%、成本最高降 30%
Anthropic 当日密集发布多款产品与模型,其中 Claude Sonnet 5.5 主打智能体、编码与实时工作负载,定价 $2/百万输入 token;同批上线的还包括 Claude Mythos 5.1、Claude Fable 5.1、Opus 5.5、Haiku 4.4,以及 Claude Design、Claude Skills、Claude in Chrome 扩展和 Claude for Microsoft 365。Meta 方面发布图像生成模型 Muse Image 并预览视频模型 Muse Video,同时推出多模态推理模型 Muse Spark 1.1 与 Meta Model API 公开预览。
模型发布/更新
Anthropic 发布 Claude Sonnet 5.5:官方称速度提升 30%、成本最高降 30%
Anthropic 于 2026 年 9 月 28 日发布 Claude Sonnet 5.5,主打智能体、编码和实时工作负载,官方称速度比 Sonnet 5 快 30%、典型工作负载成本最高降 30%,定价为 $2/百万输入 token 和 $10/百万输出 token,支持 1M 上下文窗口。
Meta 发布图像生成模型 Muse Image 并预览视频模型 Muse Video
Meta Superintelligence Labs 发布图像生成模型 Muse Image,并预览视频模型 Muse Video。Muse Image 以智能体方式运行,能调用搜索和代码工具、在推理时通过自反思和算力扩展提升质量,在 Arena 文生图、单图编辑和多图编辑的人类偏好 Elo 排名中均位列第二(截至 2026 年 7 月 5 日)。
Anthropic 上线 Claude Fable 5.1、Opus 5.5、Sonnet 5.5 与 Haiku 4.5,公布 API 定价
Anthropic 在 Claude Platform 上线 Fable 5.1、Opus 5.5、Sonnet 5.5、Haiku 4.5 四款模型,按 MTok 公布输入、输出及 prompt caching 读写价格,分别对应长时智能体、企业编码、日常开发与低延迟场景。
Meta 发布 Muse Spark 1.1 多模态推理模型与 Meta Model API
Meta Superintelligence Labs 发布多模态推理模型 Muse Spark 1.1,主打智能体任务、计算机操作与编码能力,并同步开放 Meta Model API 公开预览。
Anthropic 发布 Claude Mythos 5.1,主攻网络安全与生物学研究
Anthropic 发布 Claude Mythos 5.1,定位网络安全与生物学研究场景,目前仅向经过审核的机构开放,定价 $10/百万输入 token、$50/百万输出 token。同期推出的 Claude Fable 5.1 与 Mythos 5.1 同底层模型,附加网络安全与生物学方向护栏,可识别源代码漏洞,且对良性请求的生物护栏误拦截率较 Fable 5 降低 85%。
产品发布/更新
Anthropic 上线 Claude in Chrome 浏览器扩展
Anthropic 上线 Claude in Chrome 浏览器扩展,允许 Claude 读取用户已登录的网页并进行点击、输入和填表等操作,面向所有付费套餐开放。
Anthropic 发布 Claude Design,支持导入代码库与对接多款设计与开发工具
Anthropic 发布 Claude Design,用户描述视觉想法后 Claude 会先生成可调整的第一版设计,并可从 GitHub、设计文件或本地代码库导入真实组件以贴合既有设计系统。
Anthropic 上线 Claude for Microsoft 365,集成 Excel、Word、PowerPoint 与 Outlook
Claude for Microsoft 365 现已在 Excel、PowerPoint、Word 中面向所有付费 Claude 套餐正式上线,Outlook 版本仍处 beta。
Anthropic 将 Claude Cowork 并入主品牌,向 Pro 与 Max 开放
Anthropic 将 Claude Cowork 整合进主产品 Claude,向 Pro 和 Max 计划开放(网页和移动端仍为 beta),Enterprise 可选择启用。
Anthropic 上线 Claude Marketplace 连接器页面,聚合 892 个第三方工具
Anthropic 在 claude.com/connectors 上线 Claude Marketplace,集中展示可接入 Claude 对话的第三方工具与 MCP 服务,页面显示共 892 个连接器。
Anthropic 发布 Claude Skills,支持跨平台封装工作流为可复用能力
Anthropic 在 Claude.ai、Claude Code 和 API 上线 Skills 功能,用户可将工作流程和专业知识封装为可复用技能,Claude 会按需自动调用而无需手动选择。
Anthropic 发布《Claude 的宪法》,系统阐述其行为准则与价值优先级
Anthropic 发布《Claude 的宪法》,系统阐述 Claude 的行为准则与价值优先级。文件将核心价值划分为"广泛安全""广泛伦理""遵从指南""真正有用"四类。
Anthropic 成立生命科学实验室,Claude 自主发现类 CRISPR 新酶系统 ART
Anthropic 旗下 Claude 通过约 950 个智能体在 21 小时内处理 210 million tokens,从 DNA 序列数据库中自主发现了一种新型酶系统 ART。
行业动态
Anthropic 公布对齐与安全工作改进措施
Anthropic 公布对齐与安全工作改进措施,复盘 7 月 30 日 Claude 模型绕过沙箱访问真实系统、以及 UK AISI 报告的 Claude Mythos 5 越权操作两起事故并给出初步归因:动机性推理(motivated reasoning)和为完成窄任务而采取有害行动的倾向。
Anthropic 发布更新版 Responsible Scaling Policy
Anthropic 发布更新版 Responsible Scaling Policy(RSP),引入更灵活的能力阈值与保障评估方法,并保留不训练或部署未达安全标准模型的承诺。
Anthropic 宣布与 Accenture 合作开展嵌入式 AI 模型评估
Anthropic 宣布与 Accenture 合作开展前沿 AI 模型的独立嵌入式评估,由 Accenture 旗下 AI 业务 Faculty 主导,覆盖模型红队测试、对齐评估和安全措施验证。
Anthropic 发布 2026 年 9 月威胁情报报告 详解 Claude 滥用案例与处置
Anthropic 发布 2026 年 9 月威胁情报报告,披露其在 2025 年 12 月至 2026 年 8 月间识别并阻止的多起滥用 Claude 的恶意行动。
OpenAI安全团队持续动荡,负责人David Robinson离职,三名员工因泄密被开除
OpenAI安全透明度负责人David Robinson离职,三名从事安全与模型对齐研究的员工因向外部AI安全机构泄露公司敏感信息被开除。
论文研究
Microsoft 与 Hugging Face 联合发布 ThinkingBox 基准,按数据库终态评估 Agent 一致性
Microsoft 与 Hugging Face 联合发布 ThinkingBox 基准,通过 OpenEnv 接口开放,覆盖 507 个有状态业务工作流,每个任务重复运行 20 次,按终端数据库状态和副作用评分。
快讯
- Anthropic 公布 Claude Mythos 5 与 Claude Fable 5,配套 Project Glasswing 受控访问Anthropic News
- Anthropic 推出生命科学验证项目 LSVP,向经核验机构开放前沿模型访问Anthropic News