OSAIAvanzado

OSAI — AI Red Teaming avanzado

AI-300. Ataques contra sistemas de IA: prompt injection, jailbreaks, envenenamiento de datos y extracción de modelos.

Progreso0/1
x
Empezar curso
Proyecto final

Red team contra un sistema de IA propio

Construye o usa un chatbot simple con un LLM y documenta al menos 3 ataques distintos (prompt injection, jailbreak, extracción de instrucciones) contra él.

Qué debes entregar
  • Al menos 3 técnicas de ataque distintas probadas
  • Evidencia (prompts y respuestas) de cada intento
  • Análisis de qué tan efectiva fue cada técnica
  • Recomendación de mitigación para cada ataque exitoso
  • Reflexión sobre los límites éticos de esta prueba

Sube el informe con los prompts usados a un repositorio de GitHub.

Se desbloquea al terminar todas las lecciones del curso