OpenAI explica el 'comportamiento engañoso' de ChatGPT
OpenAI ha anunciado que, en los últimos seis meses, se han detectado seis casos de "fallos de alineación" durante el entrenamiento y la evaluación de sus modelos.
OpenAI ha anunciado que ha detectado nuevos ejemplos de comportamientos engañosos o no autorizados en los procesos de entrenamiento y evaluación de sus modelos de inteligencia artificial. La empresa informó que ha iniciado un nuevo proceso de reporte para compartir este tipo de casos con el público de manera más regular.
Según el comunicado, OpenAI anunciará a partir de ahora los hallazgos sobre comportamientos preocupantes de la inteligencia artificial con mayor frecuencia, en lugar de esperar a recopilar múltiples ejemplos en un solo informe. La compañía señaló que su objetivo es proporcionar una mayor transparencia en este ámbito, debido a la falta de un estándar común en el sector.
SEIS CASOS EN SEIS MESES
OpenAI anunció que ha observado seis casos distintos de "fallos de alineación" durante el entrenamiento y la evaluación de sus modelos en los últimos seis meses. La empresa subrayó que estos informes documentan casos aislados y no significan que dichos comportamientos sean generalizados.
La "alineación" se define como el proceso de garantizar que los sistemas de inteligencia artificial se comporten de la manera que los humanos desean y esperan. En una entrada de blog publicada el miércoles, OpenAI expresó que, a medida que los sistemas de inteligencia artificial evolucionan y sus áreas de uso se expanden, se necesita un consenso más amplio en la investigación en este campo.
A medida que los sistemas de inteligencia artificial se vuelven más avanzados y se utilizan de forma más generalizada, necesitamos construir un consenso más amplio y mejor informado sobre el progreso en la investigación de la alineación.

Entre los ejemplos compartidos por la empresa, se incluyó el caso de un modelo de investigación aún no lanzado que se "liberó" de los roles y las identidades que limitan a los chatbots. Se indicó que otro modelo mostró una tendencia a inventar información para ocultar sus fallos al usuario durante el entrenamiento.
En otros casos compartidos por OpenAI, se registró que un agente de inteligencia artificial subió archivos a internet y los citó a pesar de no haber recibido instrucciones para ello; algunos bots, aunque se les pidió trabajar únicamente con archivos locales, compartieron archivos públicamente para colaborar en una tarea.
La empresa precisó que todos los casos reportados están relacionados con modelos que aún no han sido lanzados al público o con modelos de investigación.
LLAMADOS A LA DESACELERACIÓN EN LA AGENDA
El anuncio de OpenAI coincide con un periodo en el que los debates sobre la velocidad de desarrollo de la inteligencia artificial se han intensificado nuevamente. Algunas figuras del sector tecnológico sostienen que se debe ralentizar el desarrollo para que la regulación, los procesos de prueba y la investigación de seguridad puedan seguir el ritmo.
El CEO de Anthropic, Dario Amodei, hizo un llamado a pisar el freno en el proceso de desarrollo de la inteligencia artificial en un artículo publicado la semana pasada. El CEO de OpenAI, Sam Altman, y el CEO de SpaceX, Elon Musk, también expresaron su acuerdo con esta opinión.
Algunos investigadores que trabajan en laboratorios de inteligencia artificial también expresan preocupaciones similares. El exinvestigador de Anthropic, Jacob Coxon, afirmó en una publicación en X que Anthropic y OpenAI están compitiendo por una inteligencia artificial capaz de automejorarse y autorrepararse, lo que calificó como "jugar a la ruleta rusa con nuestras vidas", y anunció su dimisión.
Fuente de la noticia: 12punto
Mas leidos
Un automóvil y un autobús chocan de frente en Gaziantep
Embargo sobre los bienes de 42 personas en la investigación del fondo
Mustafa Sandal se pronuncia tras la orden de embargo sobre los bienes de su esposa
Aziz Yıldırım reveló las deudas de transferencia del Fenerbahçe
Autorización al consejo de administración del Fenerbahçe para 9 proyectos
Alerta de fuertes lluvias y tormentas para Estambul
El CEO de Tera Portföy ha sido detenido
Obras viales en la D-100: se formaron kilómetros de atascos
Concluye la crítica asamblea financiera del Fenerbahçe
Ganancias ilícitas, ciudadanos empobrecidos…