2026-03-06 01:40:32
AlphaGo Zero是谷歌DeepMind团队研发的围棋人工智能系统,代表AlphaGo系列的重大技术迭代。该版本完全摒弃人类棋谱输入,仅通过自我对弈与强化学习实现从零起步的围棋能力构建,不依赖任何历史对局数据或人工标注。
在训练过程中,AlphaGo Zero在三天内完成数百万盘自我对弈,即以100:0的比分完胜曾击败李世石的初代AlphaGo。此后持续训练40天,其水平进一步超越曾战胜柯洁的“Master”版本,标志着纯自主学习路径在复杂策略游戏中的可行性与高效性。
AlphaGo Zero的技术突破在于取消了监督学习阶段,直接以原始棋盘状态为输入,通过蒙特卡洛树搜索与深度神经网络联合优化策略与价值评估。这一范式不仅刷新了人工智能在围棋领域的性能上限,也为通用人工智能研究提供了可验证的算法框架和方法论参考。
热门推荐
评论区