您的位置:首页 > 其它

NLP中word2vec的使用

2016-07-16 14:23 323 查看
先将本地下载好的word2vec.zip导入linux中



解压word2vec.zip



进入word2vec文件中make一下



ls一下,会出现下面word2vecmake之后的情形



设置参数,demo-word.sh脚本中的词向量训练命令:



其中,训练的内容是README.txt文件,如果想训练其他文件导入即可。cbow可选择学习算法(CBOW或skip-gram),size为词向量长度(一般是越大越好),window为窗口(词上下文)长度,sample为采样率(一般取值为1e-3到1e-5之间),threads为并行训练的cpu线程数(取决于设备硬件条件)。

词向量训练结果会以二进制形式保存在vector.bin文件中(需结合Python gensim库进行查看和调用)。

输入./distance vector.bin 开始运算

内容来自用户分享和网络整理,不保证内容的准确性,如有侵权内容,可联系管理员处理 点击这里给我发消息
标签:  算法