「eess.AS」カテゴリーアーカイブ

Speech collage: code-switched audio generation by collaging monolingual corpora

投稿日: 2023年9月28日作成者: jarxiv

要約コードスイッチング (CS) 用の効果的な自動音声認識 (ASR) システ … 続きを読む →

カテゴリー: cs.CL, cs.LG, cs.SD, eess.AS | コメントを受け付けていません

Enhancing End-to-End Conversational Speech Translation Through Target Language Context Utilization

投稿日: 2023年9月28日作成者: jarxiv

要約より長いコンテキストを組み込むことは機械翻訳に利点があることが示されていま … 続きを読む →

カテゴリー: cs.CL, cs.SD, eess.AS | コメントを受け付けていません

Single and Multi-Speaker Cloned Voice Detection: From Perceptual to Learned Features

投稿日: 2023年9月28日作成者: jarxiv

要約合成音声クローン技術は近年大幅な進歩を遂げており、さまざまな潜在的な危害を … 続きを読む →

カテゴリー: cs.CL, cs.SD, eess.AS | コメントを受け付けていません

Exploring Speech Recognition, Translation, and Understanding with Discrete Speech Units: A Comparative Study

投稿日: 2023年9月28日作成者: jarxiv

要約通常、1 秒あたり数万のレートでサンプリングされる音声信号には冗長性が含ま … 続きを読む →

カテゴリー: cs.CL, cs.SD, eess.AS | コメントを受け付けていません

A Deep Learning System for Domain-specific Speech Recognition

投稿日: 2023年9月28日作成者: jarxiv

要約マンマシンの音声インターフェイスにより、ますますインテリジェントになるマシ … 続きを読む →

カテゴリー: cs.CL, cs.LG, cs.SD, eess.AS | コメントを受け付けていません

Cross-Modal Multi-Tasking for Speech-to-Text Translation via Hard Parameter Sharing

投稿日: 2023年9月28日作成者: jarxiv

要約エンドツーエンドの音声テキスト翻訳 (ST) における最近の研究では、テキ … 続きを読む →

カテゴリー: cs.CL, cs.SD, eess.AS | コメントを受け付けていません

High-Fidelity Speech Synthesis with Minimal Supervision: All Using Diffusion Models

投稿日: 2023年9月28日作成者: jarxiv

要約テキスト読み上げ (TTS) 手法は、音声クローン作成において有望な結果を … 続きを読む →

カテゴリー: cs.AI, cs.CL, cs.SD, eess.AS | コメントを受け付けていません

Direct Models for Simultaneous Translation and Automatic Subtitling: FBK@IWSLT2023

投稿日: 2023年9月28日作成者: jarxiv

要約この文書では、IWSLT 2023 評価キャンペーンの同時翻訳および自動字 … 続きを読む →

カテゴリー: cs.AI, cs.CL, cs.SD, eess.AS | コメントを受け付けていません

Generative Speech Recognition Error Correction with Large Language Models

投稿日: 2023年9月28日作成者: jarxiv

要約私たちは、再スコアリングとエラー修正を実行する ASR ポストプロセッサー … 続きを読む →

カテゴリー: cs.AI, cs.CL, cs.LG, cs.SD, eess.AS | コメントを受け付けていません

HyPoradise: An Open Baseline for Generative Speech Recognition with Large Language Models

投稿日: 2023年9月28日作成者: jarxiv

要約ディープニューラルネットワークの進歩により、自動音声認識 (ASR) … 続きを読む →

カテゴリー: cs.AI, cs.CL, cs.LG, cs.SD, eess.AS | コメントを受け付けていません

「eess.AS」カテゴリーアーカイブ

Speech collage: code-switched audio generation by collaging monolingual corpora

Enhancing End-to-End Conversational Speech Translation Through Target Language Context Utilization

Single and Multi-Speaker Cloned Voice Detection: From Perceptual to Learned Features

Exploring Speech Recognition, Translation, and Understanding with Discrete Speech Units: A Comparative Study

A Deep Learning System for Domain-specific Speech Recognition

Cross-Modal Multi-Tasking for Speech-to-Text Translation via Hard Parameter Sharing

High-Fidelity Speech Synthesis with Minimal Supervision: All Using Diffusion Models

Direct Models for Simultaneous Translation and Automatic Subtitling: FBK@IWSLT2023

Generative Speech Recognition Error Correction with Large Language Models

HyPoradise: An Open Baseline for Generative Speech Recognition with Large Language Models

最近の投稿

最近のコメント

アーカイブ

カテゴリー