返回报告库

AI / Technology

用神经网络进行序列到序列学习

关于这篇论文的三个关键问题

用神经网络进行序列到序列学习 解决了什么问题?

传统前馈网络通常要求输入和输出都是固定维度向量,可翻译、问答等任务的两端都是长度事先未知的序列,而且长度可能不同、对应关系也未必单调。普通 RNN 在已知对齐关系时可以逐步映射,但“先读完一段,再生成另一段”会把相关输入与输出隔得很远,形成难以训练的长期依赖。论文 §1–2,PDF 第 1–3 页

用神经网络进行序列到序列学习 的核心结论有哪些证据?

实验使用 WMT’14 英法任务的精选子集:1200 万句对、3.04 亿英文词、3.48 亿法文词;源词表 16 万、目标词表 8 万,词表外词统一替换为 UNK。下表均为论文用 tokenized、区分大小写的 BLEU 口径在 ntst14 上得到的结果,不能直接与不同预处理或 BLEU 实现的数字混比。论文 §3.1、§3.6,PDF 第 4、5 页

阅读 用神经网络进行序列到序列学习 时最需要注意什么局限?

实验使用 WMT’14 英法任务的精选子集:1200 万句对、3.04 亿英文词、3.48 亿法文词;源词表 16 万、目标词表 8 万,词表外词统一替换为 UNK。下表均为论文用 tokenized、区分大小写的 BLEU 口径在 ntst14 上得到的结果,不能直接与不同预处理或 BLEU 实现的数字混比。论文 §3.1、§3.6,PDF 第 4、5 页

今天还可免费读 2 篇新报告订阅 Pro 后无限阅读,并获得每月 10 篇新论文生成额度。升级 Pro