-
最近の投稿
- Bayesian optimization for robust robotic grasping using a sensorized compliant hand
- Lessons from Learning to Spin ‘Pens’
- Uncertainty-Aware Planning for Heterogeneous Robot Teams using Dynamic Topological Graphs and Mixed-Integer Programming
- Screw Geometry Meets Bandits: Incremental Acquisition of Demonstrations to Generate Manipulation Plans
- Search-Based Path Planning among Movable Obstacles
-
最近のコメント
表示できるコメントはありません。 cs.AI (28604) cs.CL (21619) cs.CR (2231) cs.CV (35206) cs.LG (33368) cs.RO (16520) cs.SY (2542) eess.IV (4287) eess.SY (2536) stat.ML (4474)
「eess.AS」カテゴリーアーカイブ
Google USM: Scaling Automatic Speech Recognition Beyond 100 Languages
要約 本論文では、100以上の言語にわたる自動音声認識(ASR)を行う単一の大規 … 続きを読む
Audio-based AI classifiers show no evidence of improved COVID-19 screening over simple symptoms checkers
要約 最近の研究では、音声録音でトレーニングされた AI 分類子が、重症急性呼吸 … 続きを読む
Goodness of Pronunciation Pipelines for OOV Problem
要約 次のレポートでは、語彙/語彙拡張技術を使用して、テスト時に OOV 問題を … 続きを読む
Synthetic Cross-accent Data Augmentation for Automatic Speech Recognition
要約 偏った ASR データセットまたはモデルに対する認識は、近年著しく増加して … 続きを読む
Leveraging Large Text Corpora for End-to-End Speech Summarization
要約 End-to-end Speech Summarization (E2E … 続きを読む
Google USM: Scaling Automatic Speech Recognition Beyond 100 Languages
要約 100 以上の言語で自動音声認識 (ASR) を実行する単一の大規模モデル … 続きを読む
LiteG2P: A fast, light and high accuracy model for grapheme-to-phoneme conversion
要約 自動音声認識 (ASR) およびテキスト読み上げ (TTS) のフロントエ … 続きを読む
TranSpeech: Speech-to-Speech Translation With Bilateral Perturbation
要約 個別のユニットを使用した音声から音声への直接翻訳 (S2ST) は、音声表 … 続きを読む
Internal Language Model Estimation based Adaptive Language Model Fusion for Domain Adaptation
要約 ASR モデルの展開環境は絶えず変化しており、着信音声はセッション中に異な … 続きを読む
I Know Your Feelings Before You Do: Predicting Future Affective Reactions in Human-Computer Dialogue
要約 現在の音声対話システム (SDS) は、多くの場合、ユーザーの音声を受信し … 続きを読む