word2vec 的使用和学习笔记

在进行word2vecde 词向量的使用之前,需要对数据进行结巴分词(import jieba)


需要训练的数据路径:

path = "c:\\User\\Administrator\\train.txt"

保存的路径:

 "c:\\User\\Administrator\\cut_file.txt"



结巴完成之后保存数据。

进行word2vec数据的训练,把完成保存,数据类型为.bin(二进制文件)(可以新建一个文本文件,打开,另存为,设置为.bin格式)

对训练完成的数据进行使用。

gensim.models.KeyedVectors.load_word2vec_format("C:\\Users\\Administrator\\data_ci.bin",binary = True)

这里需要注意的是:原先的word2vec.Word2Vec("C:\\Users\\Administrator\\data_ci.bin",binary = True)方法已经被弃用。

需要用:gensim.models.KeyedVectors.load_word2vec_format方法。

最后,使用

model.most_similar("需要查找的关键词",topn=n)  n为查找几个 与需要查找的关键词 相关的匹配度。

---------------------

作者:不要怂,就是干

来源:CSDN

原文:https://blog.csdn.net/weixin_42013825/article/details/87900469

版权声明:本文为博主原创文章,转载请附上博文链接!

©著作权归作者所有,转载或内容合作请联系作者
【社区内容提示】社区部分内容疑似由AI辅助生成,浏览时请结合常识与多方信息审慎甄别。
平台声明:文章内容(如有图片或视频亦包括在内)由作者上传并发布,文章内容仅代表作者本人观点,简书系信息发布平台,仅提供信息存储服务。

相关阅读更多精彩内容

  • 模型创建 Gensim中 Word2Vec 模型的期望输入是进过分词的句子列表,即是某个二维数组。这里我们暂时使用...
    chaaffff阅读 2,188评论 0 5
  • 转载自:https://districtdatalabs.silvrback.com/modern-methods...
    Traeyee阅读 1,442评论 0 0
  • 未完 待译 word2vec 模块——使用word2vec进行深度学习 models.word2vec – Dee...
    凌冰_lonny阅读 20,282评论 0 55
  • 这几天带着同学去了石屏,感受原汁原味的豆腐,一个人,你索取时间长了,和付出,大爱时间长了,脸上表情不一样的。其实那...
    youcare33阅读 139评论 0 0
  • 1,伪类:before、 :after 这两个伪类都是html中无法看到的,相当于凭空变出来的。 二者都必须添加d...
    春木橙云阅读 444评论 0 1

友情链接更多精彩内容