Ya dominas el Machine Learning supervisado, pero RL es otro paradigma
Sabes entrenar modelos con datos etiquetados, pero aquí no hay dataset: hay un agente, un ambiente y recompensas. Quieres incorporar el marco teórico completo, no recetas sueltas.
Curso: Reinforcement Learning
La promo termina en:
Un curso inédito en la región sobre aprendizaje por refuerzo: la técnica para entrenar agentes que toman decisiones en ambientes no estáticos, la misma que subyace a productos revolucionarios como ChatGPT. Recorrerás desde el RL clásico (Multi Armed Bandits, procesos de decisión de Markov) hasta Deep Reinforcement Learning y los sistemas del estado del arte.
Sabes entrenar modelos con datos etiquetados, pero aquí no hay dataset: hay un agente, un ambiente y recompensas. Quieres incorporar el marco teórico completo, no recetas sueltas.
Lees que los productos más revolucionarios de la IA usan aprendizaje por refuerzo y te quedas en el titular. Quieres el camino técnico que conecta el RL clásico con sistemas como AlphaGo y ChatGPT.
Optimización, control, robótica, juegos: problemas donde cada acción cambia el estado del sistema. Necesitas técnicas pensadas para tomar decisiones en ambientes que no se quedan quietos.
Entras al paradigma del aprendizaje por refuerzo: ejemplos, limitaciones, enfoque e historia. Resuelves Multi Armed Bandits (el problema de elegir entre opciones inciertas maximizando la recompensa) y das el puntapié a los MDP.
Repasas probabilidad y formalizas los Markov Decision Processes y las Markov Chains (modelos matemáticos de decisiones cuyo resultado depende solo del estado actual). Ves los teoremas esenciales de RL, los operadores de Bellman como contraction mappings y programación dinámica: Policy Improvement, Policy Iteration y Value Iteration.
Aprendes métodos de Monte Carlo, la distinción entre on-policy y off-policy, Temporal Difference Learning y n-step bootstrapping (aprender de la experiencia sin esperar a que termine el episodio).
Pasas a predicción, aproximación y control on/off policy con métodos no basados en deep learning, incluida la memoization. Aprendes técnicas para definir bien un problema y aprovechar sus simetrías.
Estudias los métodos de Policy Gradient (optimizar directamente la política que sigue el agente) y entras a Deep RL, viendo la progresión de RL a lo largo del tiempo.
Cierras con Transformers y el estado del arte: los sistemas que marcaron época, como AlphaGo y ChatGPT.
Rindes el examen final del curso, el paso que valida tu certificación en Reinforcement Learning.
Te conectas con un docente para resolver tus dudas.
Avanzas cuando tienes el tiempo y las repites las veces que necesites.
Sigues tu avance módulo por módulo en un solo lugar.
El contenido se actualiza a medida que cambian las herramientas del mercado. Te mantienes al día con especialistas en IA.
Preguntas y compartes con gente que está resolviendo los mismos problemas.
Al aprobar el examen final obtienes una certificación válida para tu CV o LinkedIn.
Más de 50 docentes con experiencia en la industria, la investigación y universidades de Latinoamérica.
Al terminar obtienes una certificación de Humai para sumar a tu LinkedIn o tu CV. No es un diploma de asistencia: prueba que aprobaste el examen final del curso.
Organizá tu ruta, seguí tu progreso y enterate de los próximos eventos desde la app, en un solo lugar.
Mirá talleres y streams recientes con especialistas en IA, datos y tecnología.
Con Sebastián Mesch Henriques
StreamCon Pablo Marinozi
Ver encuentro →Con Charly Molero
Un caso de uso concreto como excusa para conversar sobre cómo se evalúa un agente de IA: qué es lo que se mide en realidad, de cuántas maneras distintas puede fallar, y por qué un único puntaje promedio suele esconder lo que más importa.
Ver encuentro →
StreamCon Valentina Werle
Ver encuentro →
TallerCon Justina Navarro
Ver encuentro →
TallerCon Francis Felici
Ver encuentro →Resuelve tus dudas para empezar a estudiar lo que más te interesa.
con Sebastián Mesch Henriques · Licenciado en Psicología con orientación a Neurociencias trabajando en Ciencia de Datos e IA. Cursando una Maestría en IA. Coordinador Académico de Humai e investigador adjunto en el área de las Neurociencias Cognitivas Computacionales
Aprovechá el encuentro 🔥
Este curso está incluido en Esencial y Pro. Básico incluye otros 7 cursos esenciales.
Día del Estudiante · por tiempo limitado
30% OFF
20 de septiembre - 30 de septiembre
| Beneficio | Básico | Esencial | Pro |
|---|---|---|---|
| Catálogo de cursos | 7 cursos esenciales, 1 a la vez | Todo el catálogo, hasta 3 en paralelo | Todo el catálogo, hasta 3 en paralelo |
| Programas completos | — | ✓ | ✓ |
| Ingreso de consultas | Ilimitadas, respuesta async | Ilimitadas | Ilimitadas |
| Clases desde tus consultas | — | Hasta 3 por ciclo, sujetas a disponibilidad | 2 por ciclo, garantizadas |
| Clases y talleres Humai Live | Solo por stream, sin sala en vivo | ✓ | ✓ |
| Streams públicos | ✓ | ✓ | ✓ |
| Certificados de curso / taller | 1 de curso por mes | 2 / 3 por ciclo | 3 / 3 por ciclo |
| Comunidad | ✓ | ✓ | ✓ |
| Profe designado | — | — | ✓ |
| LAB: llevá tu propio proyecto de IA a la práctica | — | — | ✓ |
Sin permanencia. Si cancelás, conservás el acceso hasta el final del período pagado.
Las clases son dinámicas y complementan los videos de manera efectiva. Han logrado encontrar una manera de enseñar de forma eficiente a distancia.
Me pareció excelente el contenido, los temas, las formas, la capacidad de todos los profes para explicar cosas complejas de una forma amena y clara, la preocupación permanente pq no queden dudas, el respeto absoluto para cuando alguien tiene dudas o preguntas. Se nota el amplio conocimiento y expertise en la materia. Estoy muy c…
FacundoCreo que ofrecen un curso de muy buena calidad. Soy profe e investigador, llevo un tiempo formándome en datos, y de las muchas experiencias que he tenido, definitivamente es la mejor en calidad y cantidad. Creo que sirve mucho la metodología de los videos grabados y después las clases sincrónicas para dudas y ejercicios. El mate…
RodrigoProyectos reales desarrollados por estudiantes y docentes en Humai LAB.

Agustín Rodriguez, Ezequiel Sirne, Francisco Covelli

Agustina Seminara

Ignacio
Ofrecemos dos rutas de aprendizaje:
Ruta Técnica (Data/Dev):
Ruta IA para Profesionales:
Cada carrera tiene cursos troncales obligatorios y cursos optativos para personalizar tu formación.