-
最近の投稿
- FEAST: A Flexible Mealtime-Assistance System Towards In-the-Wild Personalization
- Time-Optimized Safe Navigation in Unstructured Environments through Learning Based Depth Completion
- Advances in Compliance Detection: Novel Models Using Vision-Based Tactile Sensors
- Mass-Adaptive Admittance Control for Robotic Manipulators
- DreamGen: Unlocking Generalization in Robot Learning through Video World Models
-
最近のコメント
表示できるコメントはありません。 cs.AI (39879) cs.CL (30187) cs.CV (45175) cs.HC (3051) cs.LG (44808) cs.RO (23879) cs.SY (3632) eess.IV (5170) eess.SY (3624) stat.ML (5830)
「eess.AS」カテゴリーアーカイブ
Quantification of Tenseness in English and Japanese Tense-Lax Vowels: A Lagrangian Model with Indicator $θ_1$ and Force of Tenseness Ftense(t)
要約 母音の緊張性の概念は、伝統的に時制と緩き母音のバイナリ区別を通じて調べられ … 続きを読む
CTC-DRO: Robust Optimization for Reducing Language Disparities in Speech Recognition
要約 最新のディープラーニングモデルは、多くの場合、全体的なパフォーマンスが高い … 続きを読む
DeePen: Penetration Testing for Audio Deepfake Detection
要約 ディープフェイク – 操作または偽造オーディオおよびビデオメデ … 続きを読む
InSerter: Speech Instruction Following with Unsupervised Interleaved Pre-training
要約 スピーチの大規模な言語モデル(SpeechllMS)の最近の進歩は、かなり … 続きを読む
A Multimodal Symphony: Integrating Taste and Sound through Generative AI
要約 ここ数十年で、神経科学的および心理的研究は、味と聴覚認識の間の直接的な関係 … 続きを読む
Enabling Auditory Large Language Models for Automatic Speech Quality Evaluation
要約 音声品質評価では通常、平均オピニオンスコア(MOS)や話者類似度(SIM) … 続きを読む
Offload Rethinking by Cloud Assistance for Efficient Environmental Sound Recognition on LPWANs
要約 学習ベースの環境音認識は、生物学研究や都市規模のセンシングシステムにおける … 続きを読む
Open-Source Manually Annotated Vocal Tract Database for Automatic Segmentation from 3D MRI Using Deep Learning: Benchmarking 2D and 3D Convolutional and Transformer Networks
要約 さまざまな音声および音声アプリケーションには、磁気共鳴イメージング(MRI … 続きを読む
On Adversarial Attacks In Acoustic Drone Localization
要約 マルチローターの空中自動運転車(MAV、より広く知られている「ドローン」) … 続きを読む
Adapting Automatic Speech Recognition for Accented Air Traffic Control Communications
要約 航空交通管制(ATC)における効果的なコミュニケーションは、航空の安全性を … 続きを読む