「eess.AS」カテゴリーアーカイブ

Enhancing Speech Articulation Analysis using a Geometric Transformation of the X-ray Microbeam Dataset

投稿日: 2023年9月29日作成者: jarxiv

要約音声分析には、音声の明瞭度を正確に分析することが不可欠です。ただし、調音 … 続きを読む →

カテゴリー: cs.LG, eess.AS | コメントを受け付けていません

A Large-scale Dataset for Audio-Language Representation Learning

投稿日: 2023年9月29日作成者: jarxiv

要約 AI コミュニティは、大規模なマルチモーダルデータセットを活用した強力な … 続きを読む →

カテゴリー: cs.CV, cs.MM, cs.SD, eess.AS | コメントを受け付けていません

Audio-Visual Speaker Verification via Joint Cross-Attention

投稿日: 2023年9月29日作成者: jarxiv

要約話者検証は音声信号を使用して広く検討されており、ディープモデルを使用する … 続きを読む →

カテゴリー: cs.CV, cs.MM, cs.SD, eess.AS | コメントを受け付けていません

Joint Prediction and Denoising for Large-scale Multilingual Self-supervised Learning

投稿日: 2023年9月29日作成者: jarxiv

要約多言語自己教師あり学習 (SSL) は、多くの言語を処理するために必要な費 … 続きを読む →

カテゴリー: cs.AI, cs.CL, cs.SD, eess.AS | コメントを受け付けていません

Timbre-Trap: A Low-Resource Framework for Instrument-Agnostic Music Transcription

投稿日: 2023年9月28日作成者: jarxiv

要約近年、音楽転写に関する研究は、主にアーキテクチャ設計と楽器固有のデータ取得 … 続きを読む →

カテゴリー: cs.LG, cs.SD, eess.AS | コメントを受け付けていません

Low-rank Adaptation of Large Language Model Rescoring for Parameter-Efficient Speech Recognition

投稿日: 2023年9月28日作成者: jarxiv

要約音声認識出力スコアリングのための低ランク適応 (LoRA) に基づく神経言 … 続きを読む →

カテゴリー: cs.AI, cs.CL, cs.LG, cs.NE, cs.SD, eess.AS | コメントを受け付けていません

joint prediction and denoising for large-scale multilingual self-supervised learning

投稿日: 2023年9月28日作成者: jarxiv

要約多言語自己教師あり学習 (SSL) は、多くの言語を処理するために必要な費 … 続きを読む →

カテゴリー: cs.AI, cs.CL, cs.SD, eess.AS | コメントを受け付けていません

Seeing and hearing what has not been said; A multimodal client behavior classifier in Motivational Interviewing with interpretable fusion

投稿日: 2023年9月28日作成者: jarxiv

要約動機づけ面接 (MI) は、コラボレーションを重視し、行動の変化を促す治療 … 続きを読む →

カテゴリー: cs.AI, cs.CL, cs.LG, eess.AS | コメントを受け付けていません

Learning Speech Representation From Contrastive Token-Acoustic Pretraining

投稿日: 2023年9月28日作成者: jarxiv

要約最小教師あり音声合成 (TTS)、音声変換 (VC)、自動音声認識 (AS … 続きを読む →

カテゴリー: cs.AI, cs.CL, cs.SD, eess.AS | コメントを受け付けていません

Late Audio-Visual Fusion for In-The-Wild Speaker Diarization

投稿日: 2023年9月28日作成者: jarxiv

要約話者ダイアライゼーションは、制約された音声についてはよく研究されていますが … 続きを読む →

カテゴリー: cs.CL, cs.SD, eess.AS | コメントを受け付けていません

「eess.AS」カテゴリーアーカイブ

Enhancing Speech Articulation Analysis using a Geometric Transformation of the X-ray Microbeam Dataset

A Large-scale Dataset for Audio-Language Representation Learning

Audio-Visual Speaker Verification via Joint Cross-Attention

Joint Prediction and Denoising for Large-scale Multilingual Self-supervised Learning

Timbre-Trap: A Low-Resource Framework for Instrument-Agnostic Music Transcription

Low-rank Adaptation of Large Language Model Rescoring for Parameter-Efficient Speech Recognition

joint prediction and denoising for large-scale multilingual self-supervised learning

Seeing and hearing what has not been said; A multimodal client behavior classifier in Motivational Interviewing with interpretable fusion

Learning Speech Representation From Contrastive Token-Acoustic Pretraining

Late Audio-Visual Fusion for In-The-Wild Speaker Diarization

最近の投稿

最近のコメント

アーカイブ

カテゴリー