Modelos generativos de equipos rojos
Red teaming es una prueba de confrontación estructurada: los especialistas intentan romper su modelo y el sistema circundante antes de que lo hagan los atacantes. Para la IA generativa, los objetivos incluyen contenido dañino, filtraciones de privacidad, inyección rápida, uso indebido de herramientas y resultados sesgados. Los hallazgos alimentan un trabajo pendiente priorizado, no un informe en PDF único.