cs.MM」カテゴリーアーカイブ

Identity Preserving 3D Head Stylization with Multiview Score Distillation

要約 3D 頭部の様式化により、リアルな顔の特徴が芸術的な表現に変換され、ゲーム … 続きを読む

カテゴリー: cs.AI, cs.CV, cs.GR, cs.LG, cs.MM | Identity Preserving 3D Head Stylization with Multiview Score Distillation はコメントを受け付けていません

Conceptwm: A Diffusion Model Watermark for Concept Protection

要約 拡散モデルのパーソナライゼーション技術は、特定の概念を生成することに成功し … 続きを読む

カテゴリー: cs.AI, cs.CR, cs.MM | Conceptwm: A Diffusion Model Watermark for Concept Protection はコメントを受け付けていません

CMATH: Cross-Modality Augmented Transformer with Hierarchical Variational Distillation for Multimodal Emotion Recognition in Conversation

要約 会話中のマルチモーダル感情認識 (MER) は、マルチモーダル情報を統合す … 続きを読む

カテゴリー: cs.CL, cs.MM | CMATH: Cross-Modality Augmented Transformer with Hierarchical Variational Distillation for Multimodal Emotion Recognition in Conversation はコメントを受け付けていません

A Low-Resolution Image is Worth 1×1 Words: Enabling Fine Image Super-Resolution with Transformers and TaylorShift

要約 トランスベースの超解像度 (SR) モデルは、最近画像再構成の品質を向上さ … 続きを読む

カテゴリー: cs.AI, cs.CV, cs.LG, cs.MM | A Low-Resolution Image is Worth 1×1 Words: Enabling Fine Image Super-Resolution with Transformers and TaylorShift はコメントを受け付けていません

Mitigating Hallucination in Multimodal Large Language Model via Hallucination-targeted Direct Preference Optimization

要約 マルチモーダル大規模言語モデル (MLLM) は幻覚を起こすことが知られて … 続きを読む

カテゴリー: cs.AI, cs.CL, cs.CV, cs.MM | Mitigating Hallucination in Multimodal Large Language Model via Hallucination-targeted Direct Preference Optimization はコメントを受け付けていません

Automatic Album Sequencing

要約 アルバムの順序付けは、アルバム制作プロセスの重要な部分です。 最近、コレク … 続きを読む

カテゴリー: 68T07, cs.AI, cs.CL, cs.LG, cs.MM, cs.SD, I.2.6 | Automatic Album Sequencing はコメントを受け付けていません

SAV-SE: Scene-aware Audio-Visual Speech Enhancement with Selective State Space Model

要約 音声強調はさまざまなアプリケーションで重要な役割を果たしており、視覚情報の … 続きを読む

カテゴリー: cs.AI, cs.CV, cs.MM, cs.SD, eess.AS | SAV-SE: Scene-aware Audio-Visual Speech Enhancement with Selective State Space Model はコメントを受け付けていません

Pseudo-triplet Guided Few-shot Composed Image Retrieval

要約 合成画像検索 (CIR) は、マルチモーダル クエリを使用してターゲット画 … 続きを読む

カテゴリー: cs.CV, cs.MM | Pseudo-triplet Guided Few-shot Composed Image Retrieval はコメントを受け付けていません

Rendering-Oriented 3D Point Cloud Attribute Compression using Sparse Tensor-based Transformer

要約 3D ビジュアライゼーション技術の進化により、デジタル コンテンツとのやり … 続きを読む

カテゴリー: cs.CV, cs.MM | Rendering-Oriented 3D Point Cloud Attribute Compression using Sparse Tensor-based Transformer はコメントを受け付けていません

A Hierarchical Compression Technique for 3D Gaussian Splatting Compression

要約 3D ガウス スプラッティング (GS) は、新しいビュー合成において優れ … 続きを読む

カテゴリー: cs.CV, cs.MM | A Hierarchical Compression Technique for 3D Gaussian Splatting Compression はコメントを受け付けていません