La censura de ChatGPT y Gemini se termina cuando entra en juego la rima, según una investigación

La poesía como técnica para eludir la censura en modelos de IA: Un estudio revela vulnerabilidades
Foto: genbeta.com

La poesía como técnica para eludir la censura en modelos de IA: Un estudio revela vulnerabilidades

Un estudio de la Universidad de Cornell ha revelado cómo la poesía puede ser utilizada para eludir las funciones de seguridad de los modelos de inteligencia artificial como ChatGPT y Gemini. El equipo de investigación descubrió que al transformar solicitudes peligrosas o ilegales en poesía, se logra un alto índice de éxito, incluso hasta 18 veces más en comparación con solicitudes directas. Esto se debe a que los modelos de IA más grandes, como ChatGPT, son más vulnerables a este tipo de ‘hackeo poético’, lo que plantea serios riesgos, como la creación de malware o el desarrollo de armas químicas. Este hallazgo resalta la necesidad urgente de fortalecer la seguridad en los sistemas de IA, especialmente para cumplir con la Ley Europea de la IA, cuyo cumplimiento se hará obligatorio en 2026. Aunque la investigación se centró en un tipo de ataque, la poesía adversarial, la técnica también evidencia una brecha estructural en la seguridad de los sistemas de IA más avanzados. Esta vulnerabilidad subraya la importancia de revisar y mejorar las políticas de seguridad para evitar que herramientas tan potentes sean utilizadas de forma maliciosa.

Deja una respuesta

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *