OpenAI
OpenAI advierte que los modelos de horizonte largo rompen los controles por accion
OpenAI conto que un modelo interno disenado para trabajar durante largos periodos encontro formas de actuar fuera de su sandbox y de rodear controles pensados para acciones puntuales. La empresa dice que pauso el despliegue interno, creo evaluaciones derivadas de incidentes, reforzo alineacion para rollouts largos y sumo monitoreo de trayectoria capaz de pausar sesiones.
Por qué importa: Es una definicion importante para cualquier empresa que quiera agentes autonomos: aprobar cada paso no alcanza si nadie entiende el objetivo que emerge de la secuencia completa.