Liyize
08-16 · 华祎 / 执行董事
我最近在尝试训练一个 AI 模型
-最近在尝试训练一个策略价值神经网络 + MCTS 的模型。以前知道 AlphaZero、自我对弈这些概念,但真正自己开始做以后,才慢慢理解它们到底是怎么配合的。简单理解:策略价值网络负责判断“下一步怎么走”以及“现在这个局面怎么样”,MCTS 则利用这些判断继续搜索,寻找更好的选择。现在模型还在训练,我也还在研究。等它跑出来,看看它到底能学成什么样,再来分享这次折腾过程中发现的一些有意思的东西。
发布于 北京
分享
评论
未登录
友善发言
image-upload
评论
加载中