chatbot

一个可以使用自己语料进行训练的中文聊天机器人，目前包含seq2seq tf1.x和tf.2x版本，seqGan版本为tf1.x版本，后续计划更新pytorch版本，欢迎大家实践交流。

关于语料的说明

训练的语料是从互联网上找到的shooter的训练语料，语料质量很差劲，仅作为演示代码来用，大家可以使用自己的语料语料下载地址：https://pan.baidu.com/s/1kWYIOVt,将文件下载后放到data目录下。大家也可以使用小黄鸡的预料，地址https://github.com/zhaoyingjun/chatbot/tree/master/chineseChatbotWeb-tf2.0/train_data/seq.data

1、在下载好代码和语料之后，将语料文件放入data目录下。

2、按照数据预处理器（data_utls.py)-->execute.py(执行器)-->app.py（可视化对话模块）的顺序执行就可以了。

3、超参配置在seq2seq.ini和seq2seq_sever.ini文件中配置。

1 、在下载好代码和语料之后，将语料文件放入source_data目录下。

2、按照数据预处理器（source_data_utls.py)-->execute.py(执行器)-->app.py（可视化模块）的顺序执行就可以了

ubuntu14.04
python3.5
TF1.X: tensorflow==1.10.1或者tensorflow-gpu==1.10.1
flask==0.11.1

V1.1:已经增加中文分词，效果是变得更好了。注意在使用分词后，需要增加词典的大小，否则的话会导致词典无法覆盖训练集，导致出现很多的UNK。直接在seq2seq.ini中修改超参数enc_vocab_size和dec_vocab_size的值即可。

V2.0:增加一个基于SeqGan的版本，以增加训练的效果。

V3.0：增加TensorFlow2.0版本，目前是2.0.0alpha，训练效果见文件夹内图片，训练数据已经准备好，直接执行python3 execute即可进行训练。

V4.0:a、增加pytorch版本；b、对当前的工程结构进行调整；敬请期待。

一个可以自己进行训练的中文聊天机器人，根据自己的语料训练出自己想要的聊天机器人，可以用于智能客服、在线问答、智能聊天等场景。目前包含seq2seq、seqGAN版本和tf2.0版本。

Language:Python 70.1%Language:CSS 26.0%Language:JavaScript 2.4%Language:HTML 1.5%