-
最近の投稿
- Enhancing Trust in Autonomous Agents: An Architecture for Accountability and Explainability through Blockchain and Large Language Models
- $\mathcal{L}_1$Quad: $\mathcal{L}_1$ Adaptive Augmentation of Geometric Control for Agile Quadrotors with Performance Guarantees
- Scalable and low-cost remote lab platforms: Teaching industrial robotics using open-source tools and understanding its social implications
- Tabletop Object Rearrangement: Structure, Complexity, and Efficient Combinatorial Search-Based Solutions
- AdaCred: Adaptive Causal Decision Transformers with Feature Crediting
-
最近のコメント
表示できるコメントはありません。 cs.AI (31312) cs.CL (23684) cs.CR (2432) cs.CV (37678) cs.LG (36192) cs.RO (18300) cs.SY (2805) eess.IV (4529) eess.SY (2799) stat.ML (4795)
「93E20」カテゴリーアーカイブ
A Fisher-Rao gradient flow for entropy-regularised Markov decision processes in Polish spaces
要約 我々は、ポーランドの状態および行動空間を用いた無限地平線エントロピー正則化 … 続きを読む
Soft-constrained Schrodinger Bridge: a Stochastic Control Approach
要約 シュディンガー ブリッジは、終端分布が事前に指定された目標分布と一致する、 … 続きを読む
A Fisher-Rao gradient flow for entropy-regularised Markov decision processes in Polish spaces
要約 我々は、ポーランドの状態と行動空間を用いた無限地平線エントロピー正則化マル … 続きを読む
Stability of Q-Learning Through Design and Optimism
要約 Q ラーニングは、1980 年代に Chris Watkins の論文で導 … 続きを読む
Geometric constraints improve inference of sparsely observed stochastic dynamics
要約 タイトル:幾何学的制約は希薄に観測された確率的な動力学の推論を改善する 要 … 続きを読む