返回报告库

AI / Technology

深度上下文化词表示

关于这篇论文的三个关键问题

深度上下文化词表示 解决了什么问题?

GloVe、word2vec 一类传统方法通常为一个词类型保存一个固定向量。无论它在句子里扮演什么角色,模型拿到的起点都相同;多义性只能留给后续网络自行消化。论文用 play 举例:静态近邻混合了不同词性和词义,而双向语言模型的上下文表示能把体育含义与戏剧含义分开。[来源:论文 §2、§5.3,表 4]

深度上下文化词表示 的核心结论有哪些证据?

最醒目的单项是 SQuAD:测试 F1 从 81.1 升到 85.8,对应作者所报 24.9% 相对错误率下降。更能支持机制主张的是消融实验:在 SQuAD 开发集上,基线、只用顶层、平均所有层、学习所有层权重依次为 80.8、84.7、85.0、85.2;SNLI 与 SRL 也呈相同方向。[来源:论文 §4、§5.1,表 2]

阅读 深度上下文化词表示 时最需要注意什么局限?

下表抄录论文测试集表 1 的核心结果。“基线”是作者重现或构建的强任务模型,“+ELMo”只是在其上加入 ELMo。不同任务使用不同指标,因此只能在每一行内比较,不能说 92.22 就一定比 70.4 更好。

今天还可免费读 2 篇新报告订阅 Pro 后无限阅读,并获得每月 10 篇新论文生成额度。升级 Pro