文件名称:ansj源码下载
文件大小:24.05MB
文件格式:ZIP
更新时间:2020-09-28 15:59:23
源码 下载 分词 同义词 停用词
文本分析源码 中文分词(Chinese Word Segmentation) 指的是将一个汉字序列切分成一个一个单独的词。分词就是将连续的字序列按照一定的规范重新组合成词序列的过程。我们知道,在英文的行文中,单词之间是以空格作为自然分界符的,而中文只是字、句和段能通过明显的分界符来简单划界,唯独词没有一个形式上的分界符,虽然英文也同样存在短语的划分问题,不过在词这一层上,中文比之英文要复杂的多、困难的多。 个人网站:https://www.zhangjunbk.com