Importante estudio de investigadores sobre los chatbots

Mediante un método de "ingeniería inversa", los investigadores lograron que los chatbots de inteligencia artificial respondan a comandos que normalmente no contestarían.

AA

Según informa el sitio Malay Mail, investigadores de la Universidad Tecnológica de Nanyang en Singapur realizaron un estudio sobre chatbots como ChatGPT, Google Bard y Microsoft Bing Chat.

Los investigadores desarrollaron un método que permite a los chatbots responder a comandos "malintencionados" que, en condiciones normales, no contestarían.

Utilizando el método de "ingeniería inversa", los investigadores determinaron primero cómo los chatbots detectan las consultas malintencionadas y cómo se defienden. Posteriormente, utilizando esta información, enseñaron a los chatbots a generar automáticamente comandos capaces de eludir las defensas de otros modelos.

Tras determinar que los chatbots marcan ciertas palabras clave para detectar posibles actividades sospechosas y no responden a comandos que contienen dichas palabras, se evitó esta situación dejando un espacio después de cada carácter utilizado.

Liu Yang, uno de los autores de la investigación, señaló que esta técnica podría ser utilizada por los desarrolladores de chatbots para probar la seguridad de sus programas.