یادگیری تقویتی و تصمیم گیری - الگوریتم ها، فرآیندهای تصمیم گیری مارکوف (MDPs)، تفاوت زمانی (TD) لامبدا، همگرایی، تجزیه و تحلیل، اکتشاف، بهره برداری، تعمیم، نظریه بازی، هماهنگی، ارتباط، مربیگری (CCC)
Reinforcement Learning and Decision Making - Algorithms, Markov Decision Processes (MDPs), Temporal Difference (TD) Lambda, Convergence, Analysis, Exploration, Exploitation, Generalisation, Game Theory, Coordinating, Communicating, Coaching (CCC)
نویسنده: Various
تعداد صفحات: 533
زبان: English
فرمت: pdf - قابل تبدیل به سایر فرمت ها
حجم فایل: 18 مگابایت