最全的中文停用词表20K-机器学习文档类资源(txt为微云链接)

时间:2023-08-07 12:41:48
【文件属性】:
文件名称:最全的中文停用词表20K-机器学习文档类资源(txt为微云链接)
文件大小:58B
文件格式:TXT
更新时间:2023-08-07 12:41:48
停用词 中文 在信息检索中,为节省存储空间和提高搜索效率,在处理自然语言数据(或文本)之前或之后会自动过滤掉某些字或词,这些字或词即被称为Stop Words(停用词)。这些停用词都是人工输入、非自动化生成的,生成后的停用词会形成一个停用词表。但是,并没有一个明确的停用词表能够适用于所有的工具。甚至有一些工具是明确地避免使用停用词来支持短语搜索的。

网友评论