复述平行语料构建及其应用方法研究

王雅松; 刘明童; 张玉洁; 徐金安; 陈钰枫

文献导航

搜索文章

搜索思路

复述平行语料构建及其应用方法研究

作者：

王雅松刘明童张玉洁徐金安陈钰枫

基本信息来源于合作网站，原文需代理用户跳转至来源网站获取

复述语料构建

数据增强

迁移学习

复述识别

自然语言推理

摘要：

以汉语为研究对象,提出构建大规模高质量汉语复述平行语料的方法.基于翻译引擎进行复述数据增强,将英语复述平行语料迁移到汉语中,同时人工构建汉语复述评测数据集.基于构建的汉语复述数据,在复述识别和自然语言推理任务中验证复述数据构建及其应用方法的有效性.首先基于复述语料生成复述识别数据集,预训练基于注意力机制的神经网络句子匹配模型,训练模型捕获复述信息,然后将预训练的模型用于自然语言推理任务,改进其性能.在自然语言推理公开数据集上的评测结果表明,所构建的复述语料可有效地应用在复述识别任务中,模型可以学习复述知识.应用在自然语言推理任务中时,复述知识能有效地提升自然语言推理模型的精度,从而验证了复述知识对下游语义理解任务的有效性.所提出的复述语料构建方法不依赖语种,可为其他语言和领域提供更多的训练数据,生成高质量的复述数据,改进其他任务的性能.

内容分析

关键词云

关键词热度

相关文献

推荐文献

根据相关规定，获取原文需跳转至原文服务方进行注册认证身份信息

完成下面三个步骤操作后即可获取文献，阅读后请点击下方页面【继续获取】按钮

钛学术文献服务平台

学术出版新技术应用与公共服务实验室出品

原文合作方

获取文献流程

1.访问原文合作方请等待几秒系统会自动跳转至登录页，首次访问请先注册账号，填写基本信息后，点击【注册】

2.注册后进行实名认证，实名认证成功后点击【返回】

3.检查邮箱地址是否正确，若错误或未填写请填写正确邮箱地址，点击【确认支付】完成获取，文献将在1小时内发送至您的邮箱

*若已注册过原文合作方账号的用户，可跳过上述操作，直接登录后获取原文即可

点击【获取原文】按钮，跳转至合作网站。

首次获取需要在合作网站进行注册。

注册并实名认证，认证后点击【返回】按钮。

确认邮箱信息，点击【确认支付】，订单将在一小时内发送至您的邮箱。

* 若已经注册过合作网站账号，请忽略第二、三步，直接登录即可。

期刊分类
期刊（年）
期刊（期）
期刊推荐

力学化学地球物理学地质学基础科学综合大学学报天文学天文学、地球科学数学气象学海洋学物理学生物学生物科学自然地理学和测绘学自然科学总论自然科学理论与方法资源科学非线性科学与系统科学

北京大学学报(自然科学版)2021年第5期北京大学学报(自然科学版)2021年第4期北京大学学报(自然科学版)2021年第3期北京大学学报(自然科学版)2021年第2期北京大学学报(自然科学版)2021年第1期

按字母查找期刊：

A
B
C
D
E
F
G
H
I
J
K
L
M
N
O
P
Q
R
S
T
U
V
W
X
Y
Z
其他

联系合作广告推广: shenyukuan@paperpass.com

篇名	复述平行语料构建及其应用方法研究
来源期刊	北京大学学报（自然科学版）	学科
关键词	复述语料构建数据增强迁移学习复述识别自然语言推理
年，卷（期）	2021,（1）	所属期刊栏目	专题报道:面向人工智能的自然语言分析与理解
研究方向		页码范围	68-74
页数	7页	分类号
字数		语种	中文
DOI	10.13209/j.0479-8023.2020.078