LaserSAM: Zero-Shot Change Detection Using Visual Segmentation of Spinning LiDAR

要約

このペーパーでは、カメラ認識技術を回転 LiDAR データに適用するアプローチを紹介します。
3D LiDAR からの長期変化検出の堅牢性を向上させるために、ピンホール カメラ モデルを使用して、距離と強度の情報が仮想パースペクティブにレンダリングされます。
色相-彩度-値の画像エンコーディングは、範囲と近赤外強度によって画像を色付けするために使用されます。
LiDAR のアクティブ シーン照明により、周囲の明るさに影響されず、追加の処理を行わずに夜間と日中の変化を検出できます。
色付けされた遠近範囲画像を使用すると、既存の基礎モデルで意味領域を検出できます。
具体的には、セグメント何でもモデルは、以前に取得したマップとパスを繰り返すロボットからのライブビューの両方で、意味的に類似した領域を検出します。
両方のビューのマスクを比較することにより、ライブ スキャンの変化が検出されます。
結果は、Segment Anything モデルがシーンに導入された任意の変更の形状を正確にキャプチャできることを示しています。
このシステムは、オブジェクト再現率 82.6% と精度 47.0% を達成しました。
昼夜の照明変化を通じて変化を確実に検出できます。
ピクセルレベルのマスクが生成された後、3D ポイントと 1 対 1 の対応関係が得られるということは、2D マスクを直接使用して変更の 3D 位置を復元できることを意味します。
最終的に、検出された 3D 変化は、ローカル モーション プランナーで障害物として扱うことで回避できます。

要約(オリジナル)

This paper presents an approach for applying camera perception techniques to spinning LiDAR data. To improve the robustness of long-term change detection from a 3D LiDAR, range and intensity information are rendered into virtual perspectives using a pinhole camera model. Hue-saturation-value image encoding is used to colourize the images by range and near-IR intensity. The LiDAR’s active scene illumination makes it invariant to ambient brightness, which enables night-to-day change detection without additional processing. Using the colourized, perspective range image allows existing foundation models to detect semantic regions. Specifically, the Segment Anything Model detects semantically similar regions in both a previously acquired map and live view from a path-repeating robot. By comparing the masks in both views, changes in the live scan are detected. Results indicate that the Segment Anything Model is capable of accurately capturing the shape of arbitrary changes introduced into scenes. The system achieves an object recall of 82.6% and a precision of 47.0%. Changes can be detected through day-to-night illumination variations reliably. After pixel-level masks are generated, the one-to-one correspondence with 3D points means that the 2D masks can be directly used to recover the 3D location of the changes. Eventually, the detected 3D changes can be avoided by treating them as obstacles in a local motion planner.

arxiv情報

著者 Alexander Krawciw,Sven Lilge,Timothy D. Barfoot
発行日 2024-02-15 20:46:52+00:00
arxivサイト arxiv_id(pdf)

提供元, 利用サービス

arxiv.jp, Google

カテゴリー: cs.RO パーマリンク