返回报告库

AI / Technology

神经机器翻译联合学习对齐与翻译

关于这篇论文的三个关键问题

神经机器翻译:联合学习对齐与翻译 解决了什么问题?

早期神经机器翻译通常用一个编码器读取整个源句,再用一个解码器生成目标句。中间只传递一个固定维度向量。无论输入是 6 个词还是 50 个词,都要挤进同样大小的接口。论文的核心判断是:这会让模型在长句上更难保留所有翻译所需的信息。[来源:§1、§2.1]

神经机器翻译:联合学习对齐与翻译 的核心结论有哪些证据?

最直接的对照是同样最大训练长度下,带对齐的 RNNsearch 明显高于固定向量的 RNNenc:长度上限 30 时高 7.57 BLEU,长度上限 50 时高 8.93 BLEU。不过最佳神经模型 28.45 仍低于 Moses 的 33.30;论文证明的是机制带来显著改进,不是当时已经拿到整体最佳系统。[来源:表 1;差值为据表中数字计算]

阅读 神经机器翻译:联合学习对齐与翻译 时最需要注意什么局限?

作者从 WMT 2014 英法数据中使用约 1200 万句对,英语约 3.48 亿词、法语约 3.04 亿词;两侧词表各限制为 3 万词,未登录词统一映射为特殊符号。训练模型最多使用长度 30 或 50 的句子。[来源:§4.1]

今天还可免费读 2 篇新报告订阅 Pro 后无限阅读,并获得每月 10 篇新论文生成额度。升级 Pro