Snapshot Spectral Clustering — a costless approach to deep clustering ensembles generation


従来のクラスタリング アルゴリズムでは、特に疎な高次元空間を考慮すると、大規模なデータセット内の複雑な依存関係を検出できないことがよくあります。
それでも、ディープ ニューラル ネットワークによって生成されたデータの複数のビューを組み合わせてクラスタリングの結果を強化するというアイデアは、まだ十分に検討されていないようです。
この論文は、この方向性を調査し、ディープ ニューラル ネットワーク、クラスタリング手法、アンサンブル学習手法の間のギャップを埋めることを目的としています。
この目標を達成するために、私たちは新しいディープ クラスタリング アンサンブル手法であるスナップショット スペクトル クラスタリングを提案します。これは、アンサンブル作成の計算コストを最小限に抑えながら、複数のデータ ビューの結合による利益を最大化するように設計されています。


Despite tremendous advancements in Artificial Intelligence, learning from large sets of data in an unsupervised manner remains a significant challenge. Classical clustering algorithms often fail to discover complex dependencies in large datasets, especially considering sparse, high-dimensional spaces. However, deep learning techniques proved to be successful when dealing with large quantities of data, efficiently reducing their dimensionality without losing track of underlying information. Several interesting advancements have already been made to combine deep learning and clustering. Still, the idea of enhancing the clustering results by combining multiple views of the data generated by deep neural networks appears to be insufficiently explored yet. This paper aims to investigate this direction and bridge the gap between deep neural networks, clustering techniques and ensemble learning methods. To achieve this goal, we propose a novel deep clustering ensemble method – Snapshot Spectral Clustering, designed to maximize the gain from combining multiple data views while minimizing the computational costs of creating the ensemble. Comparative analysis and experiments described in this paper prove the proposed concept, while the conducted hyperparameter study provides a valuable intuition to follow when selecting proper values.


著者 Adam Piróg,Halina Kwaśnicka
発行日 2023-07-17 16:01:22+00:00
arxivサイト arxiv_id(pdf)

提供元, 利用サービス, Google

カテゴリー: cs.LG パーマリンク