文件名称:正向最大匹配中文分词算法
文件大小:3.55MB
文件格式:ZIP
更新时间:2024-03-14 07:47:11
中文分词 最大匹配 正向最大匹配 用c/c++完成一
中文分词一直都是中文自然语言处理领域的基础研究。目前,网络上流行的很多中文分词软件都可以在付出较少的代价的同时,具备较高的正确率。而且不少中文分词软件支持Lucene扩展。但不管实现如何,目前而言的分词系统绝大多数都是基于中文词典的匹配算法。其中最为常见的是最大匹配算法 (Maximum Matching,以下简称MM算法) 。MM算法有三种:一种正向最大匹配,一种逆向最大匹配和双向匹配。本程序实现了正向最大匹配算法。
【文件预览】:
lewsn2008-5088166-LBChSeg_1613973615
----lewsn2008-5088166-LBChSeg.zip(3.63MB)