-
最近の投稿
- Competency-Aware Planning for Probabilistically Safe Navigation Under Perception Uncertainty
- RLPP: A Residual Method for Zero-Shot Real-World Autonomous Racing on Scaled Platforms
- Surena-V: A Humanoid Robot for Human-Robot Collaboration with Optimization-based Control Architecture
- Safe and Trustworthy Robot Pathfinding with BIM, MHA*, and NLP
- An Efficient Numerical Function Optimization Framework for Constrained Nonlinear Robotic Problems
-
最近のコメント
表示できるコメントはありません。 cs.AI (32928) cs.CL (24893) cs.CR (2546) cs.CV (39070) cs.LG (37830) cs.RO (19150) cs.SY (2930) eess.IV (4679) eess.SY (2924) stat.ML (4977)
「cs.SD」カテゴリーアーカイブ
DARNet: Dual Attention Refinement Network with Spatiotemporal Construction for Auditory Attention Detection
要約 カクテルパーティーでは、人間は注意を向ける驚くべき能力を発揮します。 聴覚 … 続きを読む
REBORN: Reinforcement-Learned Boundary Segmentation with Iterative Training for Unsupervised ASR
要約 教師なし自動音声認識 (ASR) は、音声とテキストのペアのデータを監視せ … 続きを読む
Local deployment of large-scale music AI models on commodity hardware
要約 私たちは、汎用ハードウェア上でローカルに大規模な生成 AI モデルを使用し … 続きを読む
Re-Parameterization of Lightweight Transformer for On-Device Speech Emotion Recognition
要約 エッジまたはモノのインターネット (IoT) デバイスでの機械学習モデルの … 続きを読む
A Comparative Study of Discrete Speech Tokens for Semantic-Related Tasks with Large Language Models
要約 Speech Large Language Model (Speech L … 続きを読む
Investigating the Effectiveness of Explainability Methods in Parkinson’s Detection from Speech
要約 パーキンソン病 (PD) における言語障害は、診断の重要な初期指標となりま … 続きを読む
Automatic Album Sequencing
要約 アルバムの順序付けは、アルバム制作プロセスの重要な部分です。 最近、コレク … 続きを読む
Investigating the Effectiveness of Explainability Methods in Parkinson’s Detection from Speech
要約 パーキンソン病 (PD) における言語障害は、診断の重要な初期指標となりま … 続きを読む
SAV-SE: Scene-aware Audio-Visual Speech Enhancement with Selective State Space Model
要約 音声強調はさまざまなアプリケーションで重要な役割を果たしており、視覚情報の … 続きを読む
Diffusion Models for Audio Restoration
要約 オーディオ再生デバイスの発展と高速データ伝送に伴い、エンターテインメントと … 続きを読む