微信公众号搜"智元新知"关注
微信扫一扫可直接关注哦!

CRF 中文分词开源版

程序名称:CRF

授权协议: 未知

操作系统: Windows

开发语言: C/C++

CRF 介绍

中文分词是互联网应用不可缺少的基础技术之一,也是其他语音和语言产品必不可少的技术组件。

自2003年第一届国际中文分词评测以来,由字构词的分词方法获得了压倒性优势,国内主要通过CRF开源软件包来学习该分词方法,但是CRF过于复杂的代码结构,导致了该算法的普及率。

CRF中文分词开源版仅仅包含CRF软件包中分词解码器部分,简化了CRF复杂代码结构,清除了分词解码器不需要的代码,大大提高了分词解码器的可读性和可懂度。同时为了方便学习者可视化跟踪和调试代码,在Windows平台下分别建立了VC6.0和VS2008两个工程文件,使得VC6.0用户和VS2008用户都能轻玩转中文分词。

开源包中的分词知识库较小,分词精度较低,仅供学习Crf分词算法使用,可以通过如下途径获得更高精度的分词知识库和更高速度的分词引擎DLL或OCX:
1)致电 [email protected] 或者
[email protected]
2)在博客 http://langiner.blog.51cto.com 留言
3)在搜索引擎上搜索:极速分词

CRF 官网

#

版权声明:本文内容由互联网用户自发贡献,该文观点与技术仅代表作者本人。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如发现本站有涉嫌侵权/违法违规的内容, 请发送邮件至 [email protected] 举报,一经查实,本站将立刻删除。

相关推荐