Axon 07: Reinforcement Learning & Agentic Decision Systems

Welcome to the Reinforcement Learning & Agentic Decision Systems Axon. This track synthesizes mathematics, physics models, and deep learning into autonomous decision agents capable of mastering high-stakes games, strategic alliance coordination, and real-time robot control policies.


Modules in this Axon

1. Markov Decision Processes & Reward Engineering


2. Value Functions & Deep Q-Learning


3. Policy Gradients & Actor-Critic Methods


4. Monte Carlo Tree Search & Match Strategists


← Previous Axon: Localization & State Estimation
Curriculum Home
Restart Track: Math Foundations ↺