Making Parametric Anomaly Detection on Tabular Data Non-Parametric Again


私たちは、変換モデルが \textit{normal} サンプルのマスクされた特徴を再構成することを学習する、再構成ベースのアプローチを提案します。
KNN ベースおよびアテンションベースのモジュールの有効性をテストして、ターゲット サンプルの再構成プロセスに役立つ関連サンプルを選択します。
31 の表形式データセットのベンチマークに関する実験では、この再構成ベースの異常検出 (AD) 手法を、検索モジュールを介したノンパラメトリックな関係で強化すると、パフォーマンスが大幅に向上する可能性があることが明らかになりました。


Deep learning for tabular data has garnered increasing attention in recent years, yet employing deep models for structured data remains challenging. While these models excel with unstructured data, their efficacy with structured data has been limited. Recent research has introduced retrieval-augmented models to address this gap, demonstrating promising results in supervised tasks such as classification and regression. In this work, we investigate using retrieval-augmented models for anomaly detection on tabular data. We propose a reconstruction-based approach in which a transformer model learns to reconstruct masked features of \textit{normal} samples. We test the effectiveness of KNN-based and attention-based modules to select relevant samples to help in the reconstruction process of the target sample. Our experiments on a benchmark of 31 tabular datasets reveal that augmenting this reconstruction-based anomaly detection (AD) method with non-parametric relationships via retrieval modules may significantly boost performance.


著者 Hugo Thimonier,Fabrice Popineau,Arpad Rimmel,Bich-Liên Doan
発行日 2024-01-30 14:33:18+00:00
arxivサイト arxiv_id(pdf)

提供元, 利用サービス, Google

カテゴリー: cs.LG パーマリンク