本项目的目的是学习并实现Q-Learning及DQN算法,算法基于的游戏环境是一个基于Pygame开发的FlappyBird游戏。
运行Game.py可以运行游戏。
运行Q-learning.ipynb可以运行Q-learning算法。
运行DQN.ipynb可以运行DQN算法。
另外,本项目已实现全局优化算法的接口,并实现了一个群体模拟退火算法的简单例子,详见SA.ipynb.
pip install -r requirements.txt项目具体介绍详见B站:强化学习玩Flappy Bird?Q-Learning vs DQN!
该项目签署了MIT 授权许可,详情请参阅 LICENSE


