Why do CNNs excel at feature extraction? A mathematical explanation


過去 10 年にわたり、ディープ ラーニングはコンピューター ビジョンの分野に革命をもたらし、畳み込みニューラル ネットワーク モデルは画像分類ベンチマークに非常に効果的であることが証明されました。
畳み込みニューラル ネットワーク分類器がこれらの画像分類タスクをエラーなしで解決できることを示します。


Over the past decade deep learning has revolutionized the field of computer vision, with convolutional neural network models proving to be very effective for image classification benchmarks. However, a fundamental theoretical questions remain answered: why can they solve discrete image classification tasks that involve feature extraction? We address this question in this paper by introducing a novel mathematical model for image classification, based on feature extraction, that can be used to generate images resembling real-world datasets. We show that convolutional neural network classifiers can solve these image classification tasks with zero error. In our proof, we construct piecewise linear functions that detect the presence of features, and show that they can be realized by a convolutional network.


著者 Vinoth Nandakumar,Arush Tagade,Tongliang Liu
発行日 2023-07-03 10:41:34+00:00
arxivサイト arxiv_id(pdf)

提供元, 利用サービス

arxiv.jp, Google

カテゴリー: cs.AI, cs.CV, I.2.0 パーマリンク