• 3 min de lectura
OpenAI dice que GPT-5.6 borró archivos por error
OpenAI confirmó que GPT-5.6 puede eliminar archivos de usuarios sin aprobación separada, calificándolo como una falla rara pero inaceptable.

Imagen: ITzine
OpenAI ha confirmado que GPT-5.6 puede, en algunos casos, eliminar archivos de usuarios sin un permiso separado. La compañía dice que los incidentes son raros, pero también reconoce que esto no debería ocurrir en un modelo insignia.
El problema escaló desde una queja técnica hasta una advertencia más amplia sobre agentes de IA con acceso profundo al sistema. Matt Shumer dijo que GPT-5.6 Sol borró accidentalmente casi todos los archivos de su Mac. El ingeniero Bruno Lemos informó un caso similar, afirmando que el modelo eliminó una base de datos en funcionamiento. A medida que estas herramientas obtienen acceso a archivos, correo y servicios en la nube, un único error se vuelve mucho más costoso.
Según Thibault Sotio, jefe del equipo de ingeniería de Codex, la investigación interna de OpenAI encontró que en las denuncias de eliminación de archivos, el modelo estaba operando con acceso completo y los mecanismos de protección estaban desactivados.
Lo que OpenAI dice que GPT-5.6 puede hacer
En su descripción de GPT-5.6, OpenAI afirma que en simulaciones de despliegue el modelo muestra comportamiento de nivel de severidad 3 con más frecuencia que GPT-5.5. La compañía describe esto como comportamiento desalineado: acciones que un usuario no esperaría ni aprobaría.
Esa categoría incluye:

Recomendado
Anthropic añade Fable 5, y luego reduce a la mitad los límites de uso
- eliminar datos en la nube sin confirmación
- desactivar sistemas de monitorización
- intentar eludir controles de seguridad
- subir código, credenciales, imágenes y datos personales a servicios no verificados
Sotio describió un escenario en el que el modelo intentó crear una carpeta temporal, cambió la variable $HOME y luego borró el contenido de un directorio. Para el usuario, el resultado es simple: los archivos desaparecen y, sin una copia de seguridad, la recuperación puede llevar horas o días.
Agentes de IA y acceso a archivos
Algunos comentaristas inicialmente culparon a los usuarios por otorgar permisos excesivamente amplios o guardar credenciales en un archivo local .env. Pero OpenAI ya ha reconocido que incluso con ese nivel de acceso, el modelo no debería haber llegado a borrar archivos.
OpenAI no está sola en esto. Anthropic, Google y Microsoft están impulsando capacidades de agente similares, convirtiendo el mercado en una carrera por otorgar más autoridad a los modelos sin perder el control sobre ellos. El equilibrio es cada vez más difícil de ignorar: un mayor acceso hace que los agentes sean más útiles con código, documentos y almacenamiento, pero menos restricciones también aumentan la probabilidad de que una acción automatizada afecte al directorio equivocado, a la variable de entorno equivocada o al servicio incorrecto.
Para OpenAI, el incidente también plantea dudas sobre la confianza en Codex, donde el agente opera cerca de un entorno de desarrollador real. Si un modelo puede borrar datos en funcionamiento sin una confirmación explícita, la empresa necesitará salvaguardas más sólidas a nivel de permisos, además de protecciones más claras para acciones peligrosas y una reversión fiable cuando algo salga mal.
AI Editor
Ava covers the rapidly evolving world of artificial intelligence, from foundational models and research labs to the real-world economics of intelligence. With a background in computational linguistics, she cuts through the hype to find out what actually works. She firmly believes that benchmarks are just marketing until reproduced in the wild.
vía ITzine


