xmnlp — 轻量级中文 nlp 工具

2018-02-28 20:51:42 +08:00
 seanlee97

为了方便工作学习,于是乎借鉴了一些项目并结合自己想法写了个 nlp 工具包。

小明 nlp 目前支持:

中文分词主要基于词典,算法采用了与结巴分词类似的 DAG 图,采用了 HMM+Viterbi 新词识别, 支持自定义词典

文本纠错采用了 bigram + levenshtein 距离实现,文本纠错我主要用在 chatbot 和智能硬件中

项目地址:xmnlp

3001 次点击
所在节点    Python
3 条回复
nciyuan
2018-03-01 01:11:33 +08:00
先生?
northisland
2018-03-01 08:14:10 +08:00
厉害了
yuewolf
2018-03-01 11:13:00 +08:00
一直用结巴的 STAR 一下。

这是一个专为移动设备优化的页面(即为了让你能够在 Google 搜索结果里秒开这个页面),如果你希望参与 V2EX 社区的讨论,你可以继续到 V2EX 上打开本讨论主题的完整版本。

https://www.v2ex.com/t/433644

V2EX 是创意工作者们的社区,是一个分享自己正在做的有趣事物、交流想法,可以遇见新朋友甚至新机会的地方。

V2EX is a community of developers, designers and creative people.

© 2021 V2EX