卡内基梅隆等团队用 AI Ataraxos 击败史上最强 Stratego 玩家
卡内基梅隆、MIT、纽约大学和斯坦福的研究团队开发的 AI Ataraxos 以 15 胜 1 负 4 平的战绩击败堪称史上最强的 Stratego 玩家 Pim Niemeijer。该系统仅用 16 块 GPU 和数千美元完成训练,研究者 Eugene Vinitsky 指出 Stratego 的难点在于海量隐藏信息在长时间尺度上逐步展开。
卡内基梅隆、MIT、纽约大学和斯坦福的研究团队开发的 AI Ataraxos 以 15 胜 1 负 4 平的战绩击败堪称史上最强的 Stratego 玩家 Pim Niemeijer。该系统仅用 16 块 GPU 和数千美元完成训练,研究者 Eugene Vinitsky 指出 Stratego 的难点在于海量隐藏信息在长时间尺度上逐步展开。
The article is about MindTopo, a new benchmark from Microsoft Research for testing topological reasoning in multimodal AI models (VLMs - Vision Language Models). Key points。
Berkeley AI</think>
伯克利 AI Research 发布综述与视角文章,探讨自适应并行推理(Adaptive Parallel Reasoning)作为高效推理扩展的新范式。文章指出当前 Self-consistency、Best-of-N、ParaThinker、GroupThink、Hogwild!
Google Research 提出 MapTrace 合成数据生成管线,用于教多模态大语言模型(MLLM)在地图上追踪路径。该管线利用 Gemini 2.5 Pro 与 Imagen-4 生成多样化地图,并由 MLLM 充当 Mask Critic 与 Path Critic 把关质量,最终产出 200 万组带标注问答对并开源。