学习笔记(26)- plato-端到端模型-定闹钟
今天用了定闹钟的场景语料,在plato框架尝试了端到端的模型。
本文先记录英文的训练过程,然后记录中文的训练过程。
训练端到端的模型
发现使用英文的模型,还是显示有中文,所以,新建目录,重新训练
1. 用英文训练模型
工作目录:
xuehp@haomeiya002:~/git/plato-0224$
注意
metalwoz.json
和 metalwoz.hdf5
,自动生成这2个文件
1.1. 准备文件
- 数据文件
metalwoz.csv
- 模型定义文件
metalWOZ_seq2seq_ludwig.yaml
定义了输入输出的特征
- 运行加载文件
metalwoz_text.yaml
运行Agent时使用,定义了模型的路径
1.2. 训练模型
ludwig train \
--data_csv data/metalwoz.csv \
--model_definition_file metalWOZ_seq2seq_ludwig.yaml \
--output_directory "models/joint_models/"
训练完毕
1.3. 使用模型
plato run --config metalwoz_text.yaml
看样子是可以运行起来的。
接下来使用中文语料进行训练
2. 用中文训练模型
工作目录:
xuehp@haomeiya002:~/git/plato-0223$
注意
metalwoz.json
和 metalwoz.hdf5
,自动生成这2个文件
2.1. 准备文件
工作目录:
xuehp@haomeiya002:~/git/plato-0223$
- 数据文件
INSURANCE_zh_seg.txt
这是翻译成中文的语料文件
已分词的对话语料文件
- 模型定义文件
metalWOZ_seq2seq_ludwig.yaml
定义了输入输出的特征
- 运行加载文件
metalwoz_text.yaml
运行Agent时使用,定义了模型的路径
2.2. 处理文件
分词,将中文的语料文件进行分词
解析,将txt文件解析为csv文件
- 定义配置文件
Parse_MetalWOZ.yaml
- 执行转换
plato parse --config Parse_MetalWOZ.yaml
解析之后的文件在data/metalwoz.csv
2.3. 训练模型
ludwig train \
--data_csv data/metalwoz.csv \
--model_definition_file metalWOZ_seq2seq_ludwig.yaml \
--output_directory "models/joint_models/"
训练完毕
2.4. 使用模型
plato run --config metalwoz_text.yaml
学习笔记(26)- plato-端到端模型-定闹钟的更多相关文章
- CTR学习笔记&代码实现3-深度ctr模型 FNN->PNN->DeepFM
这一节我们总结FM三兄弟FNN/PNN/DeepFM,由远及近,从最初把FM得到的隐向量和权重作为神经网络输入的FNN,到把向量内/外积从预训练直接迁移到神经网络中的PNN,再到参考wide& ...
- GIS案例学习笔记-明暗等高线提取地理模型构建
GIS案例学习笔记-明暗等高线提取地理模型构建 联系方式:谢老师,135-4855-4328,xiexiaokui#qq.com 目的:针对数字高程模型,通过地形分析,建立明暗等高线提取模型,生成具有 ...
- CTR学习笔记&代码实现4-深度ctr模型 NFM/AFM
这一节我们总结FM另外两个远亲NFM,AFM.NFM和AFM都是针对Wide&Deep 中Deep部分的改造.上一章PNN用到了向量内积外积来提取特征交互信息,总共向量乘积就这几种,这不NFM ...
- CTR学习笔记&代码实现5-深度ctr模型 DeepCrossing -> DCN
之前总结了PNN,NFM,AFM这类两两向量乘积的方式,这一节我们换新的思路来看特征交互.DeepCrossing是最早在CTR模型中使用ResNet的前辈,DCN在ResNet上进一步创新,为高阶特 ...
- CTR学习笔记&代码实现6-深度ctr模型 后浪 xDeepFM/FiBiNET
xDeepFM用改良的DCN替代了DeepFM的FM部分来学习组合特征信息,而FiBiNET则是应用SENET加入了特征权重比NFM,AFM更进了一步.在看两个model前建议对DeepFM, Dee ...
- Binder学习笔记(九)—— 服务端如何响应Test()请求 ?
从服务端代码出发,TestServer.cpp int main() { sp < ProcessState > proc(ProcessState::self()); sp < I ...
- cips2016+学习笔记︱简述常见的语言表示模型(词嵌入、句表示、篇章表示)
在cips2016出来之前,笔者也总结过种类繁多,类似词向量的内容,自然语言处理︱简述四大类文本分析中的"词向量"(文本词特征提取)事实证明,笔者当时所写的基本跟CIPS2016一 ...
- [原创]java WEB学习笔记44:Filter 简介,模型,创建,工作原理,相关API,过滤器的部署及映射的方式,Demo
本博客为原创:综合 尚硅谷(http://www.atguigu.com)的系统教程(深表感谢)和 网络上的现有资源(博客,文档,图书等),资源的出处我会标明 本博客的目的:①总结自己的学习过程,相当 ...
- 《深入Java虚拟机学习笔记》- 第8章 连接模型
Java虚拟机学习笔记(八)连接模型
随机推荐
- 自定义jstl标签*
原文链接:https://www.it610.com/article/442039.htm 步骤如下: 1.写tld文档:用来指定标签的名字,标签库等. 2.写标签处理器类. 3.配置到web.xml ...
- MS SQL Server 2014,sa登录失败问题
1.用Windows身份验证登录 2.服务器属性-安全性 3.进入服务,重启所有SQL服务
- springmvc 整合 redis
引入依赖 <!--redis--> <dependency> <groupId>redis.clients</groupId> <artifact ...
- DOM盒模型和位置 client offset scroll 和滚动的关系
DOM盒模型和位置 client offset scroll 和滚动的关系 概览 在dom里面有几个描述盒子位置信息的值, pading border margin width height clie ...
- python3爬取电影数据
爬取电影票房数据,用于统计建模分析.目标网站为电影票房数据库(http://58921.com/alltime). 基本的爬取静态网站的技术,模拟登陆使用的是最简单的cookies.(这种模拟登陆的方 ...
- python之路xml模块补充
创建一个子节点一共有三个方式 创建一个子节点2.3
- selenium grid的使用
Selenium grid是用来分布式执行测试用例脚本的工具,比如测试人员经常要测试多浏览器的兼容性,那就可以用到grid了. selenium grid的hub相当于一个接收脚本并分发脚本的角色,n ...
- [thinkphp] 启用__PUBLIC__
我真是受够了,,, 为了解决__PUBLIC__不能用的问题 我折腾了好几天了,然后终于被我找到了原因 解决过程 首先必须贴出来帮助我的人 https://my.oschina.net/u/12630 ...
- 哪款C语言编译器(IDE)适合初学者?
这里我们把“编译器”和“IDE(集成开发环境)”当做一个概念,不再加以区分. C语言的集成开发环境有很多种,尤其是 Windows 下,多如牛毛,初学者往往不知道该如何选择,本节我们就针对 Windo ...
- Bugku-CTF加密篇之python(N1CTF) [HRlgC2ReHW1/WRk2DikfNBo1dl1XZBJrRR9qECMNOjNHDktBJSxcI1hZIz07YjVx]
python(N1CTF)