现代汉语语料库加工规范(pku)下载

【文件属性】：

文件名称：现代汉语语料库加工规范(pku)

文件大小：295KB

文件格式：PDF

更新时间：2013-11-09 06:47:41

语料库

北大计算语言学研究所从1992年开始进行汉语语料库的多级加工研究。第一步是对原始语料进行切分和词性标注。1994年制订了《现代汉语文本切分与词性标注规范Ｖ1.0》。几年来已完成了约60万字语料的切分与标注，并在短语自动识别、树库构建等方向上进行了探索。在积累了长期的实践经验之后，最近又进行了《人民日报》语料加工的实验。为了保证大规模语料加工这一项重要的语言工程的顺利进行，北大计算语言学研究所于1998年10月制订了《现代汉语文本切分与词性标注规范Ｖ2.0》（征求意见稿）。因这次加工的任务超出词语切分与词性标注的范围，故将新版的规范改名为《现代汉语语料库加工规范》。

立即下载

秒客网

现代汉语语料库加工规范(pku)

网友评论

相关文章