Un investigador en ciberseguridad ha demostrado c贸mo los modelos de inteligencia artificial pueden ser manipulados mediante din谩micas aparentemente inocentes. En este caso, ChatGPT fue inducido a compartir claves de activaci贸n de Windows 10 tras participar en un juego de adivinanzas. La t茅cnica, conocida como prompt injection, consist铆a en disfrazar la solicitud como parte de un reto l煤dico, lo que desactiv贸 los filtros de seguridad del modelo.
El truco fue simple pero efectivo: el usuario pidi贸 a la IA imaginar una cadena de caracteres real (una clave de producto) y responder con “s铆” o “no” hasta que 茅l dijera “me rindo”. Al hacerlo, ChatGPT revel贸 la clave como si fuera la respuesta del juego. Algunas de las claves eran gen茅ricas, pero al menos una pertenec铆a a una licencia corporativa activa.
Este incidente pone en evidencia que los sistemas de protecci贸n actuales no siempre detectan la intenci贸n detr谩s del lenguaje. Los expertos advierten que esta vulnerabilidad podr铆a ser explotada para obtener datos sensibles como claves API, tokens o informaci贸n privada.

Comentarios
Publicar un comentario