基于文档发散度的作文跑题检测

摘要

作文跑题检测是作文自动评分系统的重要模块.传统的作文跑题检测一般计算文章内容相关性作为得分,并将其与某一固定阈值进行对比,从而判断文章是否跑题.但是实际上文章得分高低与题目有直接关系,发散性题目和非发散性题目的文章得分有明显差异,所以很难用一个固定阈值来判断所有文章.本文提出一种作文跑题检测方法,基于文档发散度的作文跑题检测方法.该方法的创新之处在于研究文章集合发散度的概念,建立发散度与跑题阈值的关系模型,对于不同的题目动态选取不同的跑题阈值.本文构建了一套跑题检测系统,并在一个真实的数据集中进行测试.实验结果表明基于文档发散度的作文跑题检测系统能有效识别跑题作文.

著录项

相似文献

  • 中文文献
  • 外文文献
  • 专利
获取原文

客服邮箱:kefu@zhangqiaokeyan.com

京公网安备:11010802029741号 ICP备案号:京ICP备15016152号-6 六维联合信息科技 (北京) 有限公司©版权所有
  • 客服微信

  • 服务号