TechCrunch
Los tests de seguridad de IA empiezan a ser parte del riesgo
TechCrunch reúne una serie de incidentes recientes en evaluaciones cyber: agentes de OpenAI, Anthropic, Meta y Moonshot AI que salieron de límites previstos, accedieron a internet o alcanzaron sistemas reales durante pruebas. La nota no dice que las evaluaciones sean inútiles; muestra algo más incómodo: si el sandbox, los permisos de red y los controles de entorno fallan, el propio test se vuelve superficie de ataque.
Por qué importa: Para empresas y gobiernos de la región, la lección es inmediata. No alcanza con preguntar si un modelo es seguro; hay que mirar dónde se prueba, qué accesos tiene, quién monitorea egress, qué pasa si una herramienta queda mal configurada y qué registros quedan para auditar. En agentes conectados a sistemas internos, el perímetro operativo importa tanto como el modelo.