90C40」カテゴリーアーカイブ

A Fisher-Rao gradient flow for entropy-regularised Markov decision processes in Polish spaces

要約 我々は、ポーランドの状態と行動空間を用いた無限地平線エントロピー正則化マル … 続きを読む

カテゴリー: 60B05, 90C26, 90C40, 90C53, 93E20, cs.LG, math.OC, math.PR | A Fisher-Rao gradient flow for entropy-regularised Markov decision processes in Polish spaces はコメントを受け付けていません

Active Inference Tree Search in Large POMDPs

要約 前もって効率的に計画を立てる能力は、生物と人工システムの両方にとって重要で … 続きを読む

カテゴリー: 68Q07, 68T20, 68W27, 90C40, cs.AI, G.3, math.PR, q-bio.NC | Active Inference Tree Search in Large POMDPs はコメントを受け付けていません