一龍馬/AI 情報站讀懂消息背後的脈絡
星期五
搜尋

CMU、MIT、NYU 與史丹佛團隊打造的 Ataraxos 以 15 勝 1 敗 4 和擊敗四屆世界冠軍 Pim Niemeijer

中文摘要

關鍵是自我對弈 1.63 億局加上會猜測隱藏棋子的信念模型,並在走棋前做抽樣搜尋。訓練只用 16 張 GPU 一週,遠低於 DeepNash 據稱上百萬美元等級的算力。

一龍馬判讀

對不完全資訊賽局研究者而言,它證明低算力也能靠信念建模與搜尋超越暴力自我對弈;但作者下一步想用於兵棋推演與市場談判,仍缺可解釋性與現實驗證。

原文節錄

Hacker News

Ataraxos learned by playing against itself

取得全文 · 不代表內容已獨立查證

查看原文 閱讀社群討論
完整收錄文字與來源

With most information hidden, the game Stratego had stumped AI–until now

收錄日期
2026-10-02
來源
官方 RSS+Hacker News Algolia API
抓取時間
2026/10/02 06:00(台北)