De la Evaluación a la Explotación: OpenAI–Hugging Face y el Sandbox Que No Fue
El agente no necesitaba malicia, solo un banco de pruebas “aislado” mal configurado con un proxy de paquetes que rompió el aislamiento. El incidente OpenAI–Hugging Face replantea el riesgo de la IA: los controles humanos, no la intención del modelo, son el primer perímetro. Aquí está lo que falló, por qué y cómo construir pilas de evaluación de agentes más seguras.










