中文自然语言处理工具包
1、Synonyms -- 号称最好的中文近义词工具包https://github.com/huyingxi/Synonymssynonyms可以用于自然语言理解的很多任务:文本对齐,推荐算法,相似度计算,语义偏移,关键字提取,概念提取,自动摘要,搜索引擎等。2、结巴分词GitHub: https://github.com/fxsjy/jieba特点支持三种分词模式:精确模式,试图将句子最精确地切
1、Synonyms -- 号称最好的中文近义词工具包
https://github.com/huyingxi/Synonyms
synonyms可以用于自然语言理解的很多任务:文本对齐,推荐算法,相似度计算,语义偏移,关键字提取,概念提取,自动摘要,搜索引擎等。
2、结巴分词
GitHub: https://github.com/fxsjy/jieba
特点
支持三种分词模式:
精确模式,试图将句子最精确地切开,适合文本分析;
全模式,把句子中所有的可以成词的词语都扫描出来, 速度非常快,但是不能解决歧义;
搜索引擎模式,在精确模式的基础上,对长词再次切分,提高召回率,适合用于搜索引擎分词。
支持繁体分词
支持自定义词典
3、哈工大LTP
简介:哈工大语言技术平台Language Technology Platform(LTP)是哈工大社会计算与信息检索研究中心历时十年开发的一整套中文语言处理系统。支持: 分词、词性标注、依存句法分析 等
http://ltp.readthedocs.io/zh_CN/latest/install.html
4. HanLP
HanLP是由一系列模型与算法组成的工具包,目标是普及自然语言处理在生产环境中的应用。提供词法分析(中文分词、词性标注、命名实体识别)、句法分析、文本分类和情感分析等功能。
魔乐社区(Modelers.cn) 是一个中立、公益的人工智能社区,提供人工智能工具、模型、数据的托管、展示与应用协同服务,为人工智能开发及爱好者搭建开放的学习交流平台。社区通过理事会方式运作,由全产业链共同建设、共同运营、共同享有,推动国产AI生态繁荣发展。
更多推荐


所有评论(0)