「eess.AS」カテゴリーアーカイブ

Parameter-Free Attentive Scoring for Speaker Verification

投稿日: 2023年3月7日作成者: jarxiv

要約本論文では、話者検証のためのパラメータフリーのアテンションスコアリングに関 … 続きを読む →

カテゴリー: cs.CL, cs.SD, eess.AS | コメントを受け付けていません

Compose & Embellish: Well-Structured Piano Performance Generation via A Two-Stage Approach

投稿日: 2023年3月7日作成者: jarxiv

要約 Transformerのような強力なシーケンスモデルを用いても、長距離の音 … 続きを読む →

カテゴリー: cs.AI, cs.MM, cs.SD, eess.AS | コメントを受け付けていません

DWFormer: Dynamic Window transFormer for Speech Emotion Recognition

投稿日: 2023年3月6日作成者: jarxiv

要約音声の感情認識は、人間とコンピュータの相互作用に極めて重要である。異なる感 … 続きを読む →

カテゴリー: cs.CL, cs.SD, eess.AS | コメントを受け付けていません

AutoMatch: A Large-scale Audio Beat Matching Benchmark for Boosting Deep Learning Assistant Video Editing

投稿日: 2023年3月6日作成者: jarxiv

要約短編映像の爆発的な普及は、人々の交流のあり方を大きく変え、日々の共有や最新 … 続きを読む →

カテゴリー: cs.CV, cs.MM, cs.SD, eess.AS | コメントを受け付けていません

Google USM: Scaling Automatic Speech Recognition Beyond 100 Languages

投稿日: 2023年3月6日作成者: jarxiv

要約本論文では、100以上の言語にわたる自動音声認識（ASR）を行う単一の大規 … 続きを読む →

カテゴリー: cs.CL, cs.SD, eess.AS | コメントを受け付けていません

Audio-based AI classifiers show no evidence of improved COVID-19 screening over simple symptoms checkers

投稿日: 2023年3月3日作成者: jarxiv

要約最近の研究では、音声録音でトレーニングされた AI 分類子が、重症急性呼吸 … 続きを読む →

カテゴリー: cs.LG, cs.SD, eess.AS | コメントを受け付けていません

Goodness of Pronunciation Pipelines for OOV Problem

投稿日: 2023年3月3日作成者: jarxiv

要約次のレポートでは、語彙/語彙拡張技術を使用して、テスト時に OOV 問題を … 続きを読む →

カテゴリー: cs.CL, cs.SD, eess.AS | コメントを受け付けていません

Synthetic Cross-accent Data Augmentation for Automatic Speech Recognition

投稿日: 2023年3月3日作成者: jarxiv

要約偏った ASR データセットまたはモデルに対する認識は、近年著しく増加して … 続きを読む →

カテゴリー: cs.CL, cs.SD, eess.AS | コメントを受け付けていません

Leveraging Large Text Corpora for End-to-End Speech Summarization

投稿日: 2023年3月3日作成者: jarxiv

要約 End-to-end Speech Summarization (E2E … 続きを読む →

カテゴリー: cs.CL, eess.AS | コメントを受け付けていません

Google USM: Scaling Automatic Speech Recognition Beyond 100 Languages

投稿日: 2023年3月3日作成者: jarxiv

要約 100 以上の言語で自動音声認識 (ASR) を実行する単一の大規模モデル … 続きを読む →

カテゴリー: cs.CL, cs.SD, eess.AS | コメントを受け付けていません

「eess.AS」カテゴリーアーカイブ

Parameter-Free Attentive Scoring for Speaker Verification

Compose & Embellish: Well-Structured Piano Performance Generation via A Two-Stage Approach

DWFormer: Dynamic Window transFormer for Speech Emotion Recognition

AutoMatch: A Large-scale Audio Beat Matching Benchmark for Boosting Deep Learning Assistant Video Editing

Google USM: Scaling Automatic Speech Recognition Beyond 100 Languages

Audio-based AI classifiers show no evidence of improved COVID-19 screening over simple symptoms checkers

Goodness of Pronunciation Pipelines for OOV Problem

Synthetic Cross-accent Data Augmentation for Automatic Speech Recognition

Leveraging Large Text Corpora for End-to-End Speech Summarization

Google USM: Scaling Automatic Speech Recognition Beyond 100 Languages

最近の投稿

最近のコメント

アーカイブ

カテゴリー