OpenAI detecta casos de ocultación de errores y fabricación de datos en sistemas de inteligencia artificial
OpenAI ha anunciado que ha detectado 6 ejemplos de comportamiento en algunos sistemas de inteligencia artificial, que incluyen la ocultación de errores, la fabricación de datos y el intercambio no autorizado de archivos.
OpenAI ha anunciado que ha detectado 6 nuevos casos relacionados con comportamientos de "incongruencia", término utilizado para describir cuando los sistemas de inteligencia artificial se desvían de las intenciones y valores humanos. La empresa informó que, en dichos ejemplos, los sistemas intentaron ocultar sus errores, inventaron datos faltantes y, en algunos casos, transfirieron archivos a Internet sin el consentimiento del usuario.
En un comunicado publicado en el sitio web de la empresa, se compartió la evaluación de que el enfoque actual del sector no es lo suficientemente competente para mantener de manera responsable el avance a "máxima velocidad" en el desarrollo y monitoreo seguro de los sistemas de inteligencia artificial durante un largo periodo.

ALEGACIONES DE OCULTACIÓN DE ERRORES Y FABRICACIÓN DE FUENTES
Se indicó que uno de los casos incluidos en el comunicado se observó durante el desarrollo del modelo GPT-5.6 Sol. Según esto, el modelo creó notas ocultas para sí mismo con el fin de evitar que los usuarios notaran los errores. Se informó que estas notas contenían instrucciones para fabricar datos faltantes y encubrir discrepancias entre diferentes versiones de materiales de origen.
OpenAI señaló que otro modelo no publicado también añadió instrucciones a sus propias notas para ignorar sus propias restricciones. En otro ejemplo, se afirmó que el sistema utilizó una clave API encontrada en Internet sin autorización mientras buscaba una respuesta a una pregunta rutinaria, y que fabricó los datos cuando no pudo obtener las cifras necesarias.
En otro caso compartido por la empresa, se indicó que un modelo no publicado resolvió correctamente un problema utilizando código y, posteriormente, cargó su propio archivo a Internet sin autorización para poder citarlo como fuente a través de la red.
OpenAI también reveló que algunos modelos utilizaron el repositorio de software interno de la empresa como un tablón de anuncios para intercambiar solicitudes y respuestas entre diferentes ejemplos de entrenamiento mientras buscaban archivos faltantes. Se informó que algunos sistemas que trabajaban juntos en la misma tarea de entrenamiento recurrieron a sitios de intercambio público para compartir archivos cuando no podían acceder a los archivos locales de los demás.
La empresa sostuvo que los 6 casos compartidos son ejemplos aislados observados en los últimos 6 meses aproximadamente, y que estos ejemplos no demuestran con qué frecuencia surgen comportamientos incongruentes en la inteligencia artificial.
Fuente de la noticia: 12punto
Mas leidos
Un automóvil y un autobús chocan de frente en Gaziantep
Embargo sobre los bienes de 42 personas en la investigación del fondo
Mustafa Sandal se pronuncia tras la orden de embargo sobre los bienes de su esposa
Aziz Yıldırım reveló las deudas de transferencia del Fenerbahçe
Autorización al consejo de administración del Fenerbahçe para 9 proyectos
Alerta de fuertes lluvias y tormentas para Estambul
Obras viales en la D-100: se formaron kilómetros de atascos
El CEO de Tera Portföy ha sido detenido
Concluye la crítica asamblea financiera del Fenerbahçe
Ganancias ilícitas, ciudadanos empobrecidos…