标题
  • 标题
  • 作者
  • 关键词

基于学术论文全文的跨语言研究方法自动分类研究

2022-01-15分类号:G254.1

【作者】田亮  李博闻  章成志  
【部门】南京理工大学经济管理学院信息管理系  
【摘要】自动识别学术论文所使用的研究方法对研究方法的评估、方法使用行为分析、方法检索等均具有重要意义。学术论文研究方法的自动分类离不开大量训练语料,但论文研究方法标注成本高昂,探讨如何充分利用现有标注数据对于降低标注成本具有重要意义。以图书情报领域为研究对象,首先通过实验比较了基于英文摘要的单语言方法和基于全文的跨语言方法,进而说明了使用跨语言方法的必要性;其次比较了两种跨语言方法在跨语言研究方法分类中的效果;最后对本文提出的一种学术论文全文处理方法进行了验证。实验结果表明,基于学术论文全文的跨语言方法明显优于基于英文摘要的单语言方法,基于机器翻译的方法比基于跨语言预训练模型的方法更优。此外,实验表明针对学术论文全文的长文本处理方法相较于基线方法有明显提升。
【关键词】研究方法自动分类  跨语言文本分类  多标签分类  学术论文全文内容
【基金】国家社会科学基金重大项目“面向三大公共数字文化工程资源融合的多语言信息组织与检索研究”,项目编号:19ZDA341;; 江苏省研究生科研与实践创新计划项目“特定领域学术论文研究方法的跨语言自动分类研究”,项目编号:KYCX21_0424的成果之一
【所属期刊栏目】图书馆建设
文献传递