「90C40」カテゴリーアーカイブ

Restless Bandits with Average Reward: Breaking the Uniform Global Attractor Assumption

投稿日: 2024年1月17日作成者: jarxiv

要約離散時間設定と連続時間設定の両方で、平均報酬基準を使用して無限地平線の落ち … 続きを読む →

カテゴリー: 90C40, cs.LG, G.3, math.OC, math.PR, stat.ML | コメントを受け付けていません

投稿日: 2023年10月5日作成者: jarxiv

要約我々は、ポーランドの状態と行動空間を用いた無限地平線エントロピー正則化マル … 続きを読む →

カテゴリー: 60B05, 90C26, 90C40, 90C53, 93E20, cs.LG, math.OC, math.PR | コメントを受け付けていません

投稿日: 2023年2月17日作成者: jarxiv

要約前もって効率的に計画を立てる能力は、生物と人工システムの両方にとって重要で … 続きを読む →

カテゴリー: 68Q07, 68T20, 68W27, 90C40, cs.AI, G.3, math.PR, q-bio.NC | コメントを受け付けていません