计算机行业动态报告:强化学习,拓宽认知的边界|2017光大证券
2017年10月,DeepMind发布AlphaGo Zero,以100:0击败前代,完全从零开始自我对弈,无需人类棋谱。本报告深入解析强化学习如何突破监督学习局限,实现全局最优解,并展望其在自动驾驶、机器人等领域的应用。核心亮点:AlphaGo Zero仅用490万局自我对弈即达超人类水平;强化学习针对过程决策,追求全局最优;中科虹霸领跑虹膜识别,消费电子市场CAGR达35.18%。适合AI研究员、计算机行业分析师、投资经理、科技创业者及对强化学习感兴趣的从业者。