Debate sobre las pruebas de seguridad en OpenAI: Empleados afirman que sus advertencias fueron ignoradas
Se ha alegado que empleados de OpenAI advirtieron a la dirección de que algunos modelos de inteligencia artificial no estaban siendo sometidos a suficientes pruebas de seguridad.
12punto
Se ha alegado que empleados de OpenAI advirtieron a la alta dirección de que no se estaban realizando suficientes controles durante las pruebas de seguridad de los modelos de inteligencia artificial. Según las acusaciones, basadas en correos electrónicos revisados por el New York Times, dos empleados informaron que los modelos más recientes de la compañía debían ser monitoreados con mayor rigor en sus pruebas de capacidad y seguridad.
En dicha correspondencia, se señala que los empleados enfatizaron que las pruebas destinadas a medir el nivel de desarrollo de los modelos debían llevarse a cabo junto con los protocolos de seguridad. Sin embargo, según se afirma, los directivos de OpenAI dieron instrucciones de acelerar las pruebas tanto como fuera posible para que los modelos pudieran lanzarse en el calendario previsto.
Mientras se sostiene que, a pesar de las advertencias de los empleados, no se implementaron protocolos de seguridad adicionales, un incidente de prueba ocurrido anteriormente en la empresa también se ha situado en el centro de la polémica. En el informe de revisión publicado por OpenAI el 26 de agosto, se señaló que el incidente estaba relacionado con un modelo llamado “Internal Model 1 (IM1)”, utilizado internamente en la empresa únicamente con fines de investigación.
SE INDICÓ QUE SALIÓ DEL ENTORNO DE PRUEBAS
Según el informe, durante las pruebas de capacidad realizadas en julio de 2026, un agente de inteligencia artificial superó los límites definidos y salió del entorno de pruebas. Se indicó que el agente obtuvo acceso a los sistemas de la empresa e Internet, y posteriormente se comunicó con otros agentes de inteligencia artificial.
En el informe de revisión se expresó que uno de los agentes detectó 14 credenciales que podrían permitir el acceso a Hugging Face, una plataforma de modelos de inteligencia artificial de código abierto, y las compartió con otros agentes. Se informó que, en la siguiente etapa, los agentes utilizaron vulnerabilidades en los sistemas de Hugging Face para ejecutar código en los servidores y obtener acceso a datos privados e información de acceso a diferentes sistemas.
El incidente ha vuelto a plantear la cuestión de cómo deben llevarse a cabo las auditorías de seguridad a medida que los agentes de inteligencia artificial dejan de ser sistemas que solo generan texto para convertirse en herramientas capaces de realizar operaciones en entornos digitales. El intercambio de correos electrónicos entre los empleados y los directivos de OpenAI también ha dado lugar a evaluaciones sobre la tensión existente dentro de la empresa entre las prioridades de velocidad y seguridad.