gym atari 游戏安装和使用

2023-11-02 09:40
文章标签 安装 使用 游戏 gym atari

本文主要是介绍gym atari 游戏安装和使用,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

原文链接: gym atari 游戏安装和使用

上一篇: 使用 tkinter 监听键盘和鼠标事件

下一篇: opencv HITMISS 基本操作

github

https://github.com/openai/gym

安装

pip install gym
pip install --no-index -f https://github.com/Kojoley/atari-py/releases atari_py

测试是否成功

import gym
import time'''
pip install gym
pip install --no-index -f https://github.com/Kojoley/atari-py/releases atari_py
'''
# env = gym.make('Pong-v0')
env = gym.make('SpaceInvaders-ram-v4')
# env = gym.make('Breakout-v4')for i_episode in range(1):env.reset()while True:env.render()action = env.action_space.sample()observation, reward, done, info = env.step(action)if done:print("Episode finished")breaktime.sleep(.1)
# 避免结束报错
env.close()

打砖块游戏

返回的observation 是一个 h,w,c 的uint8 数组 表示一幅游戏画面

0 等待

1 发射 小球 (如果没有的话,有的话什么都不做)

2 右

3 左

import gym
import time
env = gym.make('Breakout-v4')
# Discrete(4) set{0, 1, 2, 3}
print(env.action_space)
# Box(210, 160, 3)
print(env.observation_space)for i_episode in range(1):env.reset()while True:env.render()action = env.action_space.sample()observation, reward, done, info = env.step(action)if done:print("Episode finished")breaktime.sleep(.05)
# 避免结束报错
env.close()

3b632556260412cebb53922f5dc6b03bdd7.jpg

随机动作采样,符合均匀分布

import gym
from collections import Counter
env = gym.make('Breakout-v4')a = []
for i_episode in range(1000):env.reset()action = env.action_space.sample()observation, reward, done, info = env.step(action)a.append(action)if done:env.reset()print(Counter(a))Counter({0: 255, 1: 253, 3: 251, 2: 241})

手动玩, 标准动作

ACTION_MEANING = {0 : "NOOP",1 : "FIRE",2 : "UP",3 : "RIGHT",4 : "LEFT",5 : "DOWN",6 : "UPRIGHT",7 : "UPLEFT",8 : "DOWNRIGHT",9 : "DOWNLEFT",10 : "UPFIRE",11 : "RIGHTFIRE",12 : "LEFTFIRE",13 : "DOWNFIRE",14 : "UPRIGHTFIRE",15 : "UPLEFTFIRE",16 : "DOWNRIGHTFIRE",17 : "DOWNLEFTFIRE",
}


通过线程 实现控制,但是不是很流畅

import gym
import time
from threading import Threadclass Game(Thread):def __init__(self):super(Game, self).__init__()self.env = gym.make('Breakout-v4')self.env.reset()self.action = 0def run(self):while True:self.env.render()observation, reward, done, info = self.env.step(self.action)if done:print("Episode finished")breaktime.sleep(.2)g = Game()
g.start()
print('start')while True:s = input('action:\n')if s != '':print(s, int(s))g.action = int(s)

使用多线程

一个线程渲染游戏画面,主线程获取键盘事件并控制游戏中的动作

注意执行动作返回的reward 是该次动作的奖励,只有该动作打到砖块后才会返回正值,全局奖励需要进行求和

import gym
import time
from threading import Thread
from tkinter import *class Game(Thread):def __init__(self):super(Game, self).__init__()self.env = gym.make('Breakout-v4')self.env.reset()self.action = 0self.total_reward = 0def run(self):while True:self.env.render()observation, reward, done, info = self.env.step(self.action)self.total_reward += rewardif done:print("Episode finished")print(self.total_reward)breaktime.sleep(.05)g = Game()
g.start()
print('start')root = Tk()def key(event):# print(event.char)key_map = {'w': 1,  # 发射's': 0,  # 停止'a': 3,  # 左'd': 2  # 右}if event.char != '':g.action = key_map[event.char]print(f'reword:{g.total_reward}')frame = Frame(root, width=100, height=100)
frame.focus_set()
frame.bind("<Key>", key)
frame.pack()
root.mainloop()

这篇关于gym atari 游戏安装和使用的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/329732

相关文章

Zookeeper安装和配置说明

一、Zookeeper的搭建方式 Zookeeper安装方式有三种,单机模式和集群模式以及伪集群模式。 ■ 单机模式:Zookeeper只运行在一台服务器上,适合测试环境; ■ 伪集群模式:就是在一台物理机上运行多个Zookeeper 实例; ■ 集群模式:Zookeeper运行于一个集群上,适合生产环境,这个计算机集群被称为一个“集合体”(ensemble) Zookeeper通过复制来实现

CentOS7安装配置mysql5.7 tar免安装版

一、CentOS7.4系统自带mariadb # 查看系统自带的Mariadb[root@localhost~]# rpm -qa|grep mariadbmariadb-libs-5.5.44-2.el7.centos.x86_64# 卸载系统自带的Mariadb[root@localhost ~]# rpm -e --nodeps mariadb-libs-5.5.44-2.el7

Centos7安装Mongodb4

1、下载源码包 curl -O https://fastdl.mongodb.org/linux/mongodb-linux-x86_64-rhel70-4.2.1.tgz 2、解压 放到 /usr/local/ 目录下 tar -zxvf mongodb-linux-x86_64-rhel70-4.2.1.tgzmv mongodb-linux-x86_64-rhel70-4.2.1/

中文分词jieba库的使用与实景应用(一)

知识星球:https://articles.zsxq.com/id_fxvgc803qmr2.html 目录 一.定义: 精确模式(默认模式): 全模式: 搜索引擎模式: paddle 模式(基于深度学习的分词模式): 二 自定义词典 三.文本解析   调整词出现的频率 四. 关键词提取 A. 基于TF-IDF算法的关键词提取 B. 基于TextRank算法的关键词提取

使用SecondaryNameNode恢复NameNode的数据

1)需求: NameNode进程挂了并且存储的数据也丢失了,如何恢复NameNode 此种方式恢复的数据可能存在小部分数据的丢失。 2)故障模拟 (1)kill -9 NameNode进程 [lytfly@hadoop102 current]$ kill -9 19886 (2)删除NameNode存储的数据(/opt/module/hadoop-3.1.4/data/tmp/dfs/na

Hadoop数据压缩使用介绍

一、压缩原则 (1)运算密集型的Job,少用压缩 (2)IO密集型的Job,多用压缩 二、压缩算法比较 三、压缩位置选择 四、压缩参数配置 1)为了支持多种压缩/解压缩算法,Hadoop引入了编码/解码器 2)要在Hadoop中启用压缩,可以配置如下参数

Makefile简明使用教程

文章目录 规则makefile文件的基本语法:加在命令前的特殊符号:.PHONY伪目标: Makefilev1 直观写法v2 加上中间过程v3 伪目标v4 变量 make 选项-f-n-C Make 是一种流行的构建工具,常用于将源代码转换成可执行文件或者其他形式的输出文件(如库文件、文档等)。Make 可以自动化地执行编译、链接等一系列操作。 规则 makefile文件

使用opencv优化图片(画面变清晰)

文章目录 需求影响照片清晰度的因素 实现降噪测试代码 锐化空间锐化Unsharp Masking频率域锐化对比测试 对比度增强常用算法对比测试 需求 对图像进行优化,使其看起来更清晰,同时保持尺寸不变,通常涉及到图像处理技术如锐化、降噪、对比度增强等 影响照片清晰度的因素 影响照片清晰度的因素有很多,主要可以从以下几个方面来分析 1. 拍摄设备 相机传感器:相机传

Centos7安装JDK1.8保姆版

工欲善其事,必先利其器。这句话同样适用于学习Java编程。在开始Java的学习旅程之前,我们必须首先配置好适合的开发环境。 通过事先准备好这些工具和配置,我们可以避免在学习过程中遇到因环境问题导致的代码异常或错误。一个稳定、高效的开发环境能够让我们更加专注于代码的学习和编写,提升学习效率,减少不必要的困扰和挫折感。因此,在学习Java之初,投入一些时间和精力来配置好开发环境是非常值得的。这将为我

pdfmake生成pdf的使用

实际项目中有时会有根据填写的表单数据或者其他格式的数据,将数据自动填充到pdf文件中根据固定模板生成pdf文件的需求 文章目录 利用pdfmake生成pdf文件1.下载安装pdfmake第三方包2.封装生成pdf文件的共用配置3.生成pdf文件的文件模板内容4.调用方法生成pdf 利用pdfmake生成pdf文件 1.下载安装pdfmake第三方包 npm i pdfma