Deep Reinforcement Learning Course
por Hugging Face
CUR-059
Avanzado
Texto
Inglés
Hugging Face
Reinforcement Learning
🎓
Fundamental para entender la base del RLHF usado para entrenar LLMs actuales.
📖 Sobre este curso
Curso centrado en el aprendizaje por refuerzo profundo, desde los conceptos clásicos (Q-Learning) hasta PPO y arquitecturas de agentes autónomos.
📚 Temario / Contenido
Q-Learning, Policy Gradients, Actor-Critic, Proximal Policy Optimization y simulación de entornos virtuales.
📋 Requisitos
Sólido fondo en matemáticas y Deep Learning
📅 Añadido: 12/07/2026