レポート一覧へ

AI / Technology

Residual 学習で、深すぎるネットワークの学習を通しやすくする

この論文についての3つの重要な質問

Residual 学習で、深すぎるネットワークの学習を通しやすくするはどの課題を扱いますか?

Kaiming He、Xiangyu Zhang、Shaoqing Ren、Jian Sun による Deep Residual Learning for Image Recognition(2015年)。画像認識を題材に、層を増やすほど訓練しにくくなる問題へ「入力を近道で残し、必要な差分だけを学ぶ」という答えを示した論文です。 出典: arXiv:1512.03385 / 論文PDF

Residual 学習で、深すぎるネットワークの学習を通しやすくするの中心的な主張を支える根拠は何ですか?

入力と出力の次元が同じなら、近道は恒等写像なので追加パラメータも追加の計算量もほぼ不要です。次元が変わる場所だけ線形射影 (Wsx) を使えます。論文の比較では、恒等ショートカットだけでも劣化問題への効果が大きく、射影は必須ではありませんでした(論文 pp.3, 6、Eq. 2、Table 3)。

Residual 学習で、深すぎるネットワークの学習を通しやすくするを読むときに注意すべき限界は何ですか?

値は10-crop testing。Plain と ResNet の対応モデルは、ショートカット以外の深さ・幅・パラメータ数・計算量をそろえています(論文 Table 2、Fig. 4)。さらに ResNet-152 は単一モデルで top-1 21.43%、top-5 5.71%(検証時の10-crop結果)、より多くのcropを用いた評価では top-5 4.49%でした。6モデルのアンサンブルは ImageNet テストで top-5 3.57%を記録しましたが、単一モデルの結果とは分けて読む必要があります(論文 Table 3–5)。

本日はあと2本の新しいレポートを無料で読めますProなら無制限に読め、毎月10本の新しい論文解説を生成できます。Proにアップグレード