A pesar de sus grandes virtudes, los chatbots más famosos de la actualidad, como ChatGPT o Bard, tienen un grave error que puede ser explotado fácilmente y que preocupa a los investigadores.

Los chatbots de inteligencia artificial más famosos de la actualidad, como el popular ChatGPT, se ven afectados por los llamados ataques adversarios que desafían sus defensas y generan respuestas muy inapropiadas.

Para contextualizar, un ataque adversario en el contexto de la inteligencia artificial implica Modificar deliberadamente la entrada de un modelo o los datos de entrenamiento para engañar o explotar su comportamiento.

Importante no confundir esto explotar con el famoso “Modo Diablo” de ChatGPT. Este es solo un enfoque utilizado para generar respuestas groseras, pero no implica una manipulación maliciosa del sistema.

Investigadores de la Universidad Carnegie Mellon descubrieron esta vulnerabilidad al agregar una simple modificación a un mensaje, lo que demuestra que la facilidad con la que estos chatbots eluden sigue siendo un problema continuo en la actualidad.

Se ha demostrado que el ataque afecta a varios chatbots avanzados de IA, incluidos Bard de Google y Claude de Anthropic, lo que destaca que esta debilidad está presente en la mayoría de los chatbots avanzados en la actualidad. Los expertos advierten que no existe una solución rápida y que la seguridad de estos modelos de lenguaje sigue siendo un desafío sin resolver.

“No hay forma de que sepamos cómo reparar esto”, dice Zico Kolter, profesor asociado de CMU involucrado en el estudio que descubrió la vulnerabilidad. “Simplemente no sabemos cómo hacerlos seguros”, agrega.

Un grave problema con los chatbots de difícil solución

Las empresas afectadas, incluidas OpenAI, Google y Anthropic, han tomado medidas para bloquear el explota descrito, pero el problema persiste.

Los modelos de lenguaje que sustentan estos chatbots, si bien son realmente poderosos, también son propensos a producir información falsa y repetir sesgos sociales. Los ataques adversarios se suman a estos problemas y explotan el buen trabajo y diseño de estos, por lo que representa un gran desafío para la seguridad de la IA en general.

El "alucinación" de la inteligencia artificial, el gran error y peligro potencial de esta tecnología

Los expertos destacan la importancia de investigar y estudiar de forma conjunta las debilidades de estos sistemas de IA. Si bien los resultados actuales no son perjudiciales, Advierten que los chatbots con estas capacidades que ya están ocupando un espacio en Internet con sus creaciones son potencialmente peligrosos.

Es importante tener en cuenta que, a pesar de todos los esfuerzos para mejorar la seguridad de los chatbots de IA, es posible que nunca se elimine por completo el riesgo de ataques de adversarios. Sin embargo, siguiendo una colaboración general y una vigilancia constante, es posible minimizar los riesgos y garantizar un uso responsable y seguro de la inteligencia artificial.

Está claro que la seguridad de la IA se vuelve cada vez más crucial a medida que su uso se expande en miles de sectores, incluidas las redes sociales, donde la información errónea generada por la IA representa un riesgo verdaderamente peligroso.

Leer la nota Completa > La gran vulnerabilidad de ChatGPT o Bard: los ataques adversario

Leave your vote

Author

Log In

Forgot password?

Forgot password?

Enter your account data and we will send you a link to reset your password.

Your password reset link appears to be invalid or expired.

Log in

Privacy Policy

Add to Collection

No Collections

Here you'll find all collections you've created before.