基于70年报刊语料的现代汉语历时稳态词抽取与考察

摘要

本文基于70年跨度的历时报刊语料库,使用9种统计方法计算了词语的历年使用情况,并通过对稳定性、覆盖度和时间区分性能的考察筛选获得了规模3015词的历时稳态词候选词集.该词集中动词与名词各占约三分之一(其余为形容词、副词与虚词),平均词长约1.7字,前密后疏得分布于历时语料库总频序表的前7609位,覆盖了近九成语料.该部分词语中包含大量构造句子结构的核心词语.它们塑造了稳态词在词长和词类上的特性.稳态词的提取可以加深对语言生活底层与基础词汇的认识,对汉语教学、中文信息处理和语言规划都具有重要意义.

著录项

相似文献

  • 中文文献
  • 外文文献
  • 专利
获取原文

客服邮箱:kefu@zhangqiaokeyan.com

京公网安备:11010802029741号 ICP备案号:京ICP备15016152号-6 六维联合信息科技 (北京) 有限公司©版权所有
  • 客服微信

  • 服务号