单个样本结构

在这里插入图片描述


数据分析

数据尺寸
每个样本将最多有10篇context,每篇context最多有85个句子,每个句子分割后最大长度为951。
单句和文本长度分布图
在这里插入图片描述
支持句集的文本长度
在这里插入图片描述

脏数据
有些样本提的支持句对应索引超过原文本句子个数,第一个数据表示支持句索引,第二个数据为对应文本的句子个数
在这里插入图片描述


仅考虑supporting facts时,使用 bert_ucased_qa的预测准确率

在这里插入图片描述

榜单数据

在这里插入图片描述

理想模型应该分为以下模块:

  • embedding 模块
  • 文本过滤模块
  • 解答层

编辑中…

Logo

DAMO开发者矩阵,由阿里巴巴达摩院和中国互联网协会联合发起,致力于探讨最前沿的技术趋势与应用成果,搭建高质量的交流与分享平台,推动技术创新与产业应用链接,围绕“人工智能与新型计算”构建开放共享的开发者生态。

更多推荐