Pago Único del Curso
Achetez le cours une fois et accédez-y à vie
- Un paiement unique.
- Accès instantané au cours à vie.
- Acceso a la comunidad del curso.
Una guía completa de Deep Q-Learning, Policy Gradient, Actor-Critic y DDPG con PyTorch.
El Aprendizaje por Refuerzo Profundo (Deep Reinforcement Learning) es una de las ramas más avanzadas de la Inteligencia Artificial y la base de sistemas capaces de aprender a tomar decisiones complejas de forma autónoma. En este curso aprenderás desde los fundamentos hasta la implementación de Twin Delayed Deep Deterministic Policy Gradient (TD3), uno de los algoritmos más potentes para entornos de control continuo, utilizando Python, PyTorch y Google Colab.
Comenzaremos construyendo una base sólida en los conceptos esenciales del Reinforcement Learning. Entenderás cómo funcionan Q-Learning, Deep Q-Learning (DQN), Policy Gradient y Actor-Critic, descubriendo cuándo utilizar cada técnica y cómo evolucionan hasta dar lugar a algoritmos de última generación como TD3. Todo ello explicado con un enfoque visual, intuitivo y orientado a la práctica.
Una vez dominados los fundamentos, profundizaremos en la teoría detrás de Twin Delayed DDPG (TD3). Analizarás paso a paso cómo interactúan el actor y el crítico, por qué el doble crítico mejora la estabilidad del entrenamiento y cómo las diferentes estrategias del algoritmo permiten obtener un aprendizaje más robusto y eficiente en problemas complejos de control.
Finalmente, implementarás TD3 desde cero con PyTorch, desarrollando cada componente mediante ejercicios prácticos y sesiones de programación guiadas. Entrenarás agentes inteligentes en simulaciones avanzadas, como humanoides y robots cuadrúpedos capaces de aprender a caminar y correr de forma autónoma. Además, trabajarás completamente en Google Colab, sin necesidad de instalar software ni configurar entornos, para que puedas centrarte únicamente en aprender y construir modelos de Inteligencia Artificial de alto nivel.
Comprende los fundamentos del aprendizaje por refuerzo y cómo un agente aprende a tomar decisiones mediante recompensas.
Aprende a combinar redes neuronales con Q-Learning para resolver problemas de mayor complejidad.
Descubre cómo entrenar agentes optimizando directamente sus políticas de actuación en distintos entornos.
Conoce cómo colaboran el actor y el crítico para lograr un aprendizaje más estable y eficiente.
Explora el algoritmo Deep Deterministic Policy Gradient para resolver problemas de control continuo.
Aprende uno de los algoritmos más avanzados del Aprendizaje por Refuerzo Profundo y comprende por qué mejora el rendimiento de DDPG.
Desarrolla cada componente de los modelos paso a paso utilizando Python, PyTorch y ejercicios prácticos.
Construye agentes capaces de aprender tareas complejas, como controlar humanoides y robots cuadrúpedos en simulaciones.
Adquiere las habilidades necesarias para comprender, implementar y adaptar algoritmos modernos de Aprendizaje por Refuerzo Profundo en proyectos reales.
Ligency Team est une équipe internationale d'experts en programmation, intelligence artificielle, science des données et technologie, fondée par Kirill Eremenko et Hadelin de Pontevés, créateurs de certains des cours les plus populaires au monde dans ces disciplines. Avec des millions d'étudiants et une équipe pluridisciplinaire de plus de 20 professionnels, notre mission est d'offrir une formation pratique et de haute qualité qui aide les personnes de tous niveaux à développer des compétences technologiques pertinentes. Depuis 2018, nos cours sont disponibles en espagnol grâce à la collaboration avec Juan Gabriel Gomila et Frogames Formación, rapprochant le meilleur contenu éducatif de la communauté hispanophone.
Matemático, Instructor Certificado de Unity, e Instructor Online que ha formado a más de 600.000 estudiantes en todo el mundo en diferentes plataformas como Udemy y Platzi. CEO de Frogames Formación e impulsor de esta plataforma, aportando todo su conocimiento en Matemáticas, Machine Learning, Videojuegos, IA o Blockchain entre otros.
Achetez le cours une fois et accédez-y à vie
Accédez à tous les cours, communautés et extras de Frogames
Accede a todos los cursos de la ruta de