xmnlp,轻量级中文 nlp 工具

2018-02-28 21:02:02 +08:00
 seanlee97

为了方便工作学习,于是乎借鉴了一些项目并结合自己想法用 python 写了个 nlp 工具包。

小明 nlp 目前支持:

中文分词主要基于词典,算法采用了与结巴分词类似的 DAG 图,采用了 HMM+Viterbi 新词识别, 支持自定义词典

文本纠错采用了 bigram + levenshtein 距离实现,文本纠错我主要用在 chatbot 和智能硬件中

项目地址:xmnlp

4704 次点击
所在节点    自然语言处理
2 条回复
nciyuan
2018-03-01 01:11:55 +08:00
你怎么发了两次呢?
bingod
2018-03-01 15:16:26 +08:00
谢谢分享,已经 Star

这是一个专为移动设备优化的页面(即为了让你能够在 Google 搜索结果里秒开这个页面),如果你希望参与 V2EX 社区的讨论,你可以继续到 V2EX 上打开本讨论主题的完整版本。

https://www.v2ex.com/t/433646

V2EX 是创意工作者们的社区,是一个分享自己正在做的有趣事物、交流想法,可以遇见新朋友甚至新机会的地方。

V2EX is a community of developers, designers and creative people.

© 2021 V2EX