Módulo 7 · Lenguaje y LLMs
Transformers por dentro
La arquitectura detrás de los LLMs, construida desde la autoatención hasta un modelo completo.
Qué vas a aprender
- Por qué llegaron los Transformers · Teoría · ~45 min
- Autoatención desde cero · Práctica · ~90 min
- Varias cabezas de atención · Práctica · ~75 min
- Cómo sabe el modelo el orden: posiciones, RoPE y ALiBi · Práctica · ~45 min
- El Transformer completo · Práctica · ~75 min
- BERT y el lenguaje enmascarado · Práctica · ~45 min
- GPT y la predicción del siguiente token · Práctica · ~75 min
- Codificador y decodificador: T5 y BART · Teoría · ~45 min
- Mezcla de expertos (MoE) · Práctica · ~45 min
- KV cache y Flash Attention · Práctica · ~75 min
- Leyes de escala: más datos, más parámetros · Teoría · ~45 min
- Proyecto: tu Transformer desde cero · Práctica · ~120 min
Cómo se aprende aquí: cada lección termina con una práctica interactiva que se corrige sola, y los ejemplos de Python se ejecutan en tu navegador.