Intrati in legatura

Schița de curs

1. Introducere în Deep Reinforcement Learning

  • Ce este Reinforcement Learning?
  • Diferența dintre Supervised, Unsupervised și Reinforcement Learning
  • Aplicații ale DRL în 2025 (robotică, sănătate, finanțe, logistică)
  • Înțelegerea buclei de interacțiune agent-mediu

2. Fundamentele Reinforcement Learning

  • Procese decizionale Markov (MDP)
  • Funcții de stare, acțiune, recompensă, politică și valoare
  • Compromisul dintre explorare și exploatare
  • Metode Monte Carlo și învățarea Temporal-Difference (TD)

3. Implementarea algoritmilor de bază RL

  • Metode tabelare: Dynamic Programming, Policy Evaluation și Iteration
  • Q-Learning și SARSA
  • Explorare epsilon-greedy și strategii de scădere
  • Implementarea mediilor RL cu OpenAI Gymnasium

4. Tranziția la Deep Reinforcement Learning

  • Limitările metodelor tabelare
  • Folosirea rețelelor neuronale pentru aproximarea funcțiilor
  • Arhitectura și fluxul de lucru Deep Q-Network (DQN)
  • Experience replay și rețele țintă

5. Algoritmi avansați DRL

  • Double DQN, Dueling DQN și Prioritized Experience Replay
  • Metode Policy Gradient: algoritmul REINFORCE
  • Arhitecturi Actor-Critic (A2C, A3C)
  • Proximal Policy Optimization (PPO)
  • Soft Actor-Critic (SAC)

6. Lucrul cu spații de acțiune continue

  • Provocări în controlul continuu
  • Folosirea DDPG (Deep Deterministic Policy Gradient)
  • Twin Delayed DDPG (TD3)

7. Instrumente practice și framework-uri

  • Folosirea Stable-Baselines3 și Ray RLlib
  • Logging și monitorizare cu TensorBoard
  • Reglarea hiperparametrilor pentru modelele DRL

8. Reward Engineering și designul mediului

  • Reward shaping și echilibrarea penalizărilor
  • Concepte de transfer learning sim-to-real
  • Crearea de medii personalizate în Gymnasium

9. Medii parțial observabile și generalizare

  • Gestionarea informațiilor incomplete de stare (POMDP-uri)
  • Abordări bazate pe memorie folosind LSTM-uri și RNN-uri
  • Îmbunătățirea robusteții și generalizării agentului

10. Teoria jocurilor și Multi-Agent Reinforcement Learning

  • Introducere în medii multi-agent
  • Cooperare vs. competiție
  • Aplicații în antrenamentul adversarial și optimizarea strategiilor

11. Studii de caz și aplicații din lumea reală

  • Simulări de condus autonom
  • Strategii de dynamic pricing și tranzacționare financiară
  • Robotică și automatizare industrială

12. Depanare și optimizare

  • Diagnosticarea antrenării instabile
  • Gestionarea rarității recompenselor și a overfitting-ului
  • Scalarea modelelor DRL pe GPU-uri și sisteme distribuite

13. Rezumat și pașii următori

  • Recapitularea arhitecturii DRL și a algoritmilor cheie
  • Tendințe din industrie și direcții de cercetare (de exemplu, RLHF, modele hibride)
  • Resurse suplimentare și materiale de lectură

Cerințe

  • Cunoștințe solide de programare în Python
  • Înțelegerea calculului diferențial și al algebrei liniare
  • Cunoștințe de bază de probabilități și statistică
  • Experiență în construirea de modele de machine learning folosind Python și NumPy sau TensorFlow/PyTorch

Public țintă

  • Dezvoltatori interesați de AI și sisteme inteligente
  • Data Scientists care explorează framework-uri de reinforcement learning
  • Ingineri de Machine Learning care lucrează cu sisteme autonome
 21 Ore

Numărul de participanți


Pret per participant

Mărturii (3)

Cursuri viitoare

Categorii înrudite