baselines算法库baselines/bench/monitor.py模块分析

baselines算法库baselines/bench/monitor.py模块代码：

__all__ = ['Monitor', 'get_monitor_files', 'load_results']

from gym.core import Wrapper

import time

from glob import glob

import csv

import os.path as osp

import json

class Monitor(Wrapper):

    EXT = "monitor.csv"

    f = None

    def __init__(self, env, filename, allow_early_resets=False, reset_keywords=(), info_keywords=()):

        Wrapper.__init__(self, env=env)

        self.tstart = time.time()

        if filename:

            self.results_writer = ResultsWriter(filename,

                header={"t_start": time.time(), 'env_id' : env.spec and env.spec.id},

                extra_keys=reset_keywords + info_keywords

            )

        else:

            self.results_writer = None

        self.reset_keywords = reset_keywords

        self.info_keywords = info_keywords

        self.allow_early_resets = allow_early_resets

        self.rewards = None

        self.needs_reset = True

        self.episode_rewards = []

        self.episode_lengths = []

        self.episode_times = []

        self.total_steps = 0

        self.current_reset_info = {} # extra info about the current episode, that was passed in during reset()

    def reset(self, **kwargs):

        self.reset_state()

        for k in self.reset_keywords:

            v = kwargs.get(k)

            if v is None:

                raise ValueError('Expected you to pass kwarg %s into reset'%k)

            self.current_reset_info[k] = v

        return self.env.reset(**kwargs)

    def reset_state(self):

        if not self.allow_early_resets and not self.needs_reset:

            raise RuntimeError("Tried to reset an environment before done. If you want to allow early resets, wrap your env with Monitor(env, path, allow_early_resets=True)")

        self.rewards = []

        self.needs_reset = False

    def step(self, action):

        if self.needs_reset:

            raise RuntimeError("Tried to step environment that needs reset")

        ob, rew, done, info = self.env.step(action)

        self.update(ob, rew, done, info)

        return (ob, rew, done, info)

    def update(self, ob, rew, done, info):

        self.rewards.append(rew)

        if done:

            self.needs_reset = True

            eprew = sum(self.rewards)

            eplen = len(self.rewards)

            epinfo = {"r": round(eprew, 6), "l": eplen, "t": round(time.time() - self.tstart, 6)}

            for k in self.info_keywords:

                epinfo[k] = info[k]

            self.episode_rewards.append(eprew)

            self.episode_lengths.append(eplen)

            self.episode_times.append(time.time() - self.tstart)

            epinfo.update(self.current_reset_info)

            if self.results_writer:

                self.results_writer.write_row(epinfo)

            assert isinstance(info, dict)

            if isinstance(info, dict):

                info['episode'] = epinfo

        self.total_steps += 1

    def close(self):

        super(Monitor, self).close()

        if self.f is not None:

            self.f.close()

    def get_total_steps(self):

        return self.total_steps

    def get_episode_rewards(self):

        return self.episode_rewards

    def get_episode_lengths(self):

        return self.episode_lengths

    def get_episode_times(self):

        return self.episode_times

class LoadMonitorResultsError(Exception):

    pass

class ResultsWriter(object):

    def __init__(self, filename, header='', extra_keys=()):

        self.extra_keys = extra_keys

        assert filename is not None

        if not filename.endswith(Monitor.EXT):

            if osp.isdir(filename):

                filename = osp.join(filename, Monitor.EXT)

            else:

                filename = filename + "." + Monitor.EXT

        self.f = open(filename, "wt")

        if isinstance(header, dict):

            header = '# {} \n'.format(json.dumps(header))

        self.f.write(header)

        self.logger = csv.DictWriter(self.f, fieldnames=('r', 'l', 't')+tuple(extra_keys))

        self.logger.writeheader()

        self.f.flush()

    def write_row(self, epinfo):

        if self.logger:

            self.logger.writerow(epinfo)

            self.f.flush()

def get_monitor_files(dir):

    return glob(osp.join(dir, "*" + Monitor.EXT))

def load_results(dir):

    import pandas

    monitor_files = (

        glob(osp.join(dir, "*monitor.json")) +

        glob(osp.join(dir, "*monitor.csv"))) # get both csv and (old) json files

    if not monitor_files:

        raise LoadMonitorResultsError("no monitor files of the form *%s found in %s" % (Monitor.EXT, dir))

    dfs = []

    headers = []

    for fname in monitor_files:

        with open(fname, 'rt') as fh:

            if fname.endswith('csv'):

                firstline = fh.readline()

                if not firstline:

                    continue

                assert firstline[0] == '#'

                header = json.loads(firstline[1:])

                df = pandas.read_csv(fh, index_col=None)

                headers.append(header)

            elif fname.endswith('json'): # Deprecated json format

                episodes = []

                lines = fh.readlines()

                header = json.loads(lines[0])

                headers.append(header)

                for line in lines[1:]:

                    episode = json.loads(line)

                    episodes.append(episode)

                df = pandas.DataFrame(episodes)

            else:

                assert 0, 'unreachable'

            df['t'] += header['t_start']

        dfs.append(df)

    df = pandas.concat(dfs)

    df.sort_values('t', inplace=True)

    df.reset_index(inplace=True)

    df['t'] -= min(header['t_start'] for header in headers)

    df.headers = headers # HACK to preserve backwards compatibility

    return df

baselines是开源的reinforcement leanring算法库，作为最早开源最权威的reinforcement learning算法库由于多年没有进行维护了已经没有太新的算法被加入到这个算法库了，不过这个算法库之后的其他算法库虽然有一直被维护但是很多都是自行其是，很难有太过于经过检测的代码库了，因此个人认为baselines算法库依旧有其意义价值，于是在疫情宅家期间对该算法库做了一定的源码解析，不过在解析的过程中不得不说发现这个开源算法库由于是多人合作完成的虽然被社区接受和认可但是各个模块的编写风格十分迥异，而且很多模块存在造轮子的嫌疑，甚至很多模块代码优化程度不高、逻辑混乱，对此自己也只能说是不得不吐槽一下。

===============================================

该模块的核心代码为：

class Monitor(Wrapper):

该模块的功能就是将gym的env进行包装，记录下每一个episode的长度，以及每步的step的奖励reward，以及该episode的用时时长，然后将这些信息写到文本中。

由于代码量较大，实现国内较简单，意义价值不大，而且代码较为混乱就不细解析了。

=================================================

baselines算法库baselines/bench/monitor.py模块分析的更多相关文章

图像滤镜艺术---ZPhotoEngine超级算法库
原文:图像滤镜艺术---ZPhotoEngine超级算法库一直以来,都有个想法,想要做一个属于自己的图像算法库,这个想法,在经过了几个月的努力之后,终于诞生了,这就是ZPhotoEngine算法库. ...
scikit-learn 支持向量机算法库使用小结
之前通过一个系列对支持向量机(以下简称SVM)算法的原理做了一个总结,本文从实践的角度对scikit-learn SVM算法库的使用做一个小结.scikit-learn SVM算法库封装了libsvm ...
【Python】【Web.py】详细解读Python的web.py框架下的application.py模块
详细解读Python的web.py框架下的application.py模块这篇文章主要介绍了Python的web.py框架下的application.py模块,作者深入分析了web.py的源码, ...
使用织梦开源的分词算法库编写的YII获取分词扩展
在编辑文章中,很多时候都需要自动根据文章内容获取关键字的功能,因此,本文主要是说明如何在yii中使用织梦开源的分词算法编写一个独立的扩展,可以在不同的模块中使用,步骤如下: 1 到这里下载其他朋友整理 ...
mahout算法库（四）
mahout算法库分为三大块 1.聚类算法 2.协同过滤算法(一般用于推荐) 协同过滤算法也可以称为推荐算法!!! 3.分类算法算法类算法名中文名分类算法 Log ...
操作MySQL-数据库的安装及Pycharm模块的导入
操作MySQL-数据库的安装及Pycharm模块的导入 1.基于pyCharm开发环境,在CMD控制台输入依次输入以下步骤: (1)pip3 install PyMySQL < 安装 PyMy ...
痞子衡嵌入式：对比MbedTLS算法库纯软件实现与i.MXRT上DCP,CAAM硬件加速器实现性能差异
大家好,我是痞子衡,是正经搞技术的痞子.今天痞子衡给大家介绍的是MbedTLS算法库纯软件实现与i.MXRT上DCP,CAAM硬件加速器实现性能差异. 近期有 i.MXRT 客户在集成 OTA SBL ...
snowland-smx密码算法库
snowland-smx密码算法库一.snowland-smx密码算法库的介绍 snowland-smx是python实现的国密套件,对标python实现的gmssl,包含国密SM2,SM3,SM4 ...
安装Python算法库
安装Python算法库主要包括用NumPy和SciPy来处理数据,用Matplotlib来实现数据可视化.为了适应处理大规模数据的需求,python在此基础上开发了Scikit-Learn机器学习算 ...
scikit-learn 线性回归算法库小结
scikit-learn对于线性回归提供了比较多的类库,这些类库都可以用来做线性回归分析,本文就对这些类库的使用做一个总结,重点讲述这些线性回归算法库的不同和各自的使用场景. 线性回归的目的是要得到输 ...

随机推荐

vitepress使用createContentLoader时遇到["vitepress" resolved to an ESM file. ESM file cannot be loaded by `require`.]报错
在使用vitepress构建一个所有博客的概览页的时候,使用到了createContentLoader这个api,但是在index.data.ts中定义并导出后,在md文件中调用遇到了下面这个问题: ...
.Net Core+NPOI快速导入导出Excel
Excel导入导出在开发中是非常常见的,对Excel操作,NPOI使用的是最常用的,但单单用NPOI,要写得代码还是比较多的,可以借助一个Npoi.Mapper库,操作起来就非常简单了,十来行代码就可 ...
VMware 虚拟机下载
VMware破解版下载地址: https://www.aliyundrive.com/s/CUr4eaMgxGa 提取码:e0c8 激活码: ZF3R0-FHED2-M80TY-8QYGC-NPKYF ...
python 使用pandas修改数据到excel，报“SettingwithCopyWarning A value is trying to be set on a copy of a slice from a DataFrame”的解决方法
场景: 通过pandas模块,将测试数据回写到excel,测试数据有写到excel文件,但控制台输出警告信息如下警告: SettingwithCopyWarning A value is tryin ...
jdk17+spring6下打jar包
由于特定情况,本机下有多个jdk,而JAVA_HOME又只有一个. 本人习惯在命令行下一个命令编译打包程序,如何解决这个问题? 研究了不少时间,得到了两个解决方案: 1.使用bat -- 非常烂 ...
EMQX配置ssl/tls双向认证+SpringBoot项目整合MQTT_真实业务实践
一.使用docker搭建Emqx 1.拉取emqx镜像 docker pull emqx/emqx:5.7 2.运行 docker run -d --name emqx emqx/emqx:5.7 3 ...
nginx 如何利用gzip压缩配置来优化网站访问速度
前言: 最近公司设计的网站前端是基于nuxt架构的,部署到nginx上后,首页的访问以及二级页面的访问极慢,f12观察后发现主要是一些js页面加载极慢拉低了网站的访问速度,于是便想到利用nginx里的 ...
sqlCel查询一个表中部分字段的数据后插入到另一个表中
问题: 部门每天需要从后台系统将物流总表数据导出,Excel中整理出订单的物流发货渠道和发货时间,再手动导入到数据库中,整个过程不麻烦,但在Excel中比较繁琐. 需求: 将这个繁琐的过程变得更简单, ...
IdentityServer4 获取发现文档提示 Keyset is missing
客户端请求提示 Keyset is missing 解决办法添加以下代码 services.AddIdentityServer(options => { options.Events.Rais ...
HTML5、CSS3 里面都新增了那些新特性？
HTML5 新的语义标签 article 独立的内容. aside 侧边栏. header 头部. nav 导航. section 文档中的节. footer 页脚. 画布(Canvas) API 地 ...

baselines算法库baselines/bench/monitor.py模块分析

baselines算法库baselines/bench/monitor.py模块分析的更多相关文章

随机推荐

热门专题