Módulo 9 · Lenguaje y LLMs

Ajuste fino y preferencias

Convierte un modelo base en un asistente útil: LoRA, SFT, RLHF, DPO e IA constitucional.

Lecciones: 8Duración: ~11 hAcceso: incluido en todos los planes

Qué vas a aprender

  1. Fine-tuning eficiente con LoRA y QLoRA · Práctica · ~75 min
  2. Ajuste supervisado con instrucciones (SFT) · Práctica · ~90 min
  3. RLHF: recompensa y PPO aplicados a un LLM · Práctica · ~90 min
  4. DPO: preferencias sin modelo de recompensa · Práctica · ~90 min
  5. IA constitucional y modelos que se corrigen solos · Práctica · ~45 min
  6. Taller GPT 10 · Ajuste por instrucciones · Práctica · ~90 min
  7. Taller GPT 11 · DPO desde cero · Práctica · ~90 min
  8. Taller GPT 12 · Evaluación completa · Práctica · ~90 min

Cómo se aprende aquí: cada lección termina con una práctica interactiva que se corrige sola, y los ejemplos de Python se ejecutan en tu navegador.

Ver planes desde 25 € → Probar las lecciones gratis