跳到正文

全部动态

今日 38 条
9月3日周四
8月31日周一
8月25日周二
  1. Mistral AI58

    Mistral 与 HUMAIN 达成战略合作,推进沙特和中东主权 AI

    Mistral 与 HUMAIN 宣布战略合作,覆盖沙特及中东地区 AI 基础设施、先进模型开发与行业落地,合作规模达数亿欧元。双方将围绕网络安全和语音等方向开发并本地化先进 AI 模型,并计划打造在阿拉伯语上表现强劲的前沿模型。Mistral 将探索使用 HUMAIN 的数据中心基础设施以满足本地算力需求,双方还将针对受监管行业制定联合市场策略。

8月24日周一
8月13日周四
8月10日周一
  1. Import AI37

    Import AI 468:IFP 提出 23 项 RSI 政策建议,MIT 等分析 AI 竞赛中的信任与透明度博弈

    Import AI 第 468 期聚焦 AI 政策与竞赛博弈:智库 IFP 发布 23 项应对自动化 AI R&D 风险的政策建议,涵盖透明度、风险策略、AI 韧性等 7 类;MIT 与哥伦比亚大学研究者在论文《Racing to Ruin》中通过博弈模型分析,AI 企业能否实现协同放缓取决于透明度与对对手可信度的判断。

7月26日周日
5月8日周五
4月20日周一
3月13日周五
  1. Berkeley AI Research39

    SPEX 与 ProxySPEX:面向大语言模型的可扩展交互识别方法

    Berkeley AI Research 提出 SPEX 与 ProxySPEX 算法,用于在大语言模型中以可扩展方式识别驱动模型行为的特征交互。方法借助信号处理与编码理论,基于稀疏性与低阶性假设将指数级搜索重构为可解的稀疏恢复问题;ProxySPEX 进一步利用层级结构,以约 10 倍更少的消融次数达到与 SPEX 相当的性能,可应用于特征归因、数据归因与模型组件归因等可解释性任务。

1月10日周六
  1. Berkeley AI Research44

    基于信息驱动的成像系统设计

    NeurIPS 2025 论文提出基于互信息的成像系统评估与设计框架,以信息量统一替代分辨率、信噪比等传统指标。方法利用已知噪声物理直接计算噪声熵,用概率模型(如 PixelCNN)估计测量分布,在彩色摄影、射电天文、无透镜成像和显微镜四个领域验证了信息估计对解码器性能的预测能力。

8月5日周二
7月31日周四
7月29日周二
7月25日周五
7月23日周三
  1. Hugging Face Blog65

    用 Diffusers 与 PEFT 加速 Flux 的 LoRA 推理

    HF 博客给出在 Flux.1-Dev 上加速 LoRA 推理的方案,结合 Flash Attention 3、torch.compile 与 TorchAO FP8 量化,并借助 Diffusers 的 hotswap 机制避免换 LoRA 时触发重新编译。

    推荐理由:这篇博客把 Flash Attention 3、torch.compile 与 FP8 量化组合成可复用的 LoRA 推理加速配方,并给出 H100 与 RTX 4090 上的实测对照。

3月17日周一
3月7日周五
  1. Mistral AI66

    Mistral AI 发布 Mistral OCR 文档理解 API

    Mistral AI 发布文档理解 API Mistral OCR,输入图片和 PDF,输出有序的图文交错内容,已在 la Plateforme 上线,价格为 1000 pages/$,单节点最高可处理 2000 页/分钟。

    推荐理由:原文附带与主流 OCR 模型的基准对比,读者可以据此横向判断其在多语言文档理解场景中的相对位置。

2月17日周一
  1. Mistral AI40

    Mistral AI 发布 Mistral Saba:24B 参数中东与南亚区域语言模型

    Mistral AI 发布 24B 参数区域语言模型 Mistral Saba,专为中东和南亚训练,支持阿拉伯语及多种印度源语言,泰米尔语等南印度语言表现尤其突出。官方称其准确率优于 5 倍规模的模型,推理速度超过 150 tokens/秒,可通过 API 或单 GPU 系统本地部署。典型场景包括阿拉伯语对话支持、专业领域微调和文化内容创作。

7月1日周六
2月7日周二
1月16日周一
1月2日周一
12月21日周三
12月20日周二
12月15日周四
  1. Hugging Face Blog44

    Hugging Face 🤗 Datasets 音频数据集完全指南

    🤗 Datasets 是一个开源音频数据集下载与预处理库,可通过一行 Python 代码完成加载。Hugging Face Hub 上托管有 77 个语音识别数据集和 28 个音频分类数据集,文章以 GigaSpeech 为例演示 load_dataset 用法。库内置 Dataset Preview 可在线试听前 100 个样本,并支持流式模式处理大规模数据。

12月9日周五
6月22日周三
2月25日周四
  1. Hugging Face Blog47

    Hugging Face 博客:构建与调试神经网络的实用建议

    Hugging Face 工程师分享构建神经网络的三个实用步骤:动手前先深入分析数据分布、标签平衡性与噪声来源;先用 fastText、word2vec 配合逻辑回归等简单基线评估任务难度,再考虑 BERT 等复杂模型;实现完成后应尝试在小批量数据上过拟合,确认 loss 接近 0 以验证代码正确性。

1月26日周二
9月10日周四