注册 登录 进入教材巡展
#

出版时间:2026-04

出版社:科学出版社

以下为《强化学习原理与方法:从基础到前沿》的配套数字资源,这些资源在您购买图书后将免费附送给您:
  • 科学出版社
  • 9787030855787
  • 1版
  • B5
  • 2026-04
作者简介
(1) 2010-09 至 2014-07, 北京航空航天大学, 控制理论与控制工程, 博士
(2) 2006-09 至 2009-07, 湘潭大学, 控制理论与控制工程, 硕士
(3) 2002-09 至 2006-07, 湘潭大学, 测控技术与仪器, 学士(1) 2018-12 至 今, 中南大学, 自动化学院, 教授
(2) 2016-11 至 2018-11, 中国科学院自动化研究所, 副研究员
(3) 2014-09 至 2016-10, 中国科学院自动化研究所, 助理研究员
(4) 2014-06 至 2014-08, 德州农工大学卡塔尔分校, 科学系, 无
(5) 2013-09 至 2013-12, 德州农工大学卡塔尔分校, 科学系, 无
(6) 2013-02 至 2013-08, 香港城市大学, 系统工程与工程管理系, 无强化学习、智能控制与决策强化学习优化控制理论与方法 中国自动化学会自然科学奖二等奖 2024 1/2
个人奖 亚太神经网络学会(APNNS)青年科学家奖 2024 1/1[1] 2021.11-至今:副主任,中国自动化学会自适应动态规划与强化学习专业委员会
[2] 2016.7-2021.11:秘书长,中国自动化学会自适应动态规划与强化学习专业委员会
[3] 2020.1-至今:Associate Editor, IEEE Transactions on Neural Network and Learning Systems
[4] 2017.1-2022.12:Associate Editor, IEEE Transactions on Emerging Topics in Computational Intelligence
[5] 2015.1-至今:Associate Editor, Artificial Intelligence Review
[6] 2019.1-至今:Associate Editor, Neurocomputing
[7] 2018.1-至今:Associate Editor, Journal of Industrial & Management Optimization
[8] 2023:程序委员会主席,第二十三届国际神经信息处理大会(ICO
查看全部
内容简介
本书系统阐述强化学习的基本理论、核心方法与典型应用,兼顾基础知识、前沿研究与实践应用。全书分三部分:第一部分“强化学习基础”以马尔可夫决策过程为起点,系统讲解动态规划、函数逼近、值函数与策略梯度等方法,辅以严谨的数学推导与丰富示例,构建坚实的理论体系。第二部分“强化学习研究”聚焦探索与奖励机制、多智能体学习、多目标与多任务强化学习及人在回路交互等核心机制,系统总结研究成果与发展趋势。第三部分“强化学习应用”通过围棋、星际争霸2、大语言模型、计算生物学与无人机控制等案例,展现其在复杂场景中的强大能力。书中提供大量简洁易读的 Python实现代码,避免过度封装,兼具可读性与可扩展性。