DeepMind在最新Nature论文中讲述了最新版“阿法狗”—— AlphaGo Zero从零起步学围棋,经过3天之后轻松战胜其前任AlphaGo的过程。
从零开始:
和之前的“阿法狗”不同,最新版的AlphaGo Zero已经不需要人类的样例或指导,不提供基本规则以外的任何领域知识,不需要人类数据,而是完全自我学习,在自我对弈中不断提高。3天的自学后,AlphaGo Zero以100:0的成绩完虐阿法狗,也就是之前与李世石大战的那个。而经过40天左右的自学之后,他已经击败了以往任何版本的AlphaGo。
视频画面:
《暗黑4》本体免费领!永久入库随时畅玩
《金刚狼》男主真人宣发被喷上千楼!评论区彻底失控
《卧龙2》新预告官宣定档!试玩体验版来了
PS5破解惨遭重大突破!更接近完全破解了
500D的丝袜有多厚?肉腿会温暖人心的囧图
《生化危机》新电影口碑起飞!史上最佳游改作品