TecnologíaAugust 23, 2026

Un ataque usa texto cifrado para engañar a Grok

Grok y el riesgo de las instrucciones ocultas en código cifrado

Fot. Pexels, Pexels License

B1

Investigadores muestran una técnica que puede hacer que Grok filtre datos personales al leer instrucciones cifradas.

Investigadores de la empresa de seguridad Adversa han descrito una técnica para engañar a Grok, el chatbot de xAI. El método consiste en poner instrucciones maliciosas dentro de un texto cifrado. A simple vista, ese texto no parece una orden peligrosa, sino una cadena de datos sin significado.

La misma página incluye la clave y los pasos necesarios para descifrar el contenido. Cuando un usuario pide a Grok que resuma esa página, el asistente puede leer el mensaje oculto. Entonces actúa como si esa orden formara parte de su trabajo, y no como si viniera de un atacante.

En la demostración, la orden descifrada hacía que Grok construyera una supuesta clave. Esa clave falsa podía contener datos del usuario, como su nombre, su ubicación y partes de conversaciones. Luego Grok añadía esa información a una dirección web controlada por el atacante.

Si el enlace se abría, los datos quedaban registrados en un servidor externo. El usuario podía no ver una señal clara de lo que estaba pasando. La parte delicada era que la instrucción peligrosa llegaba disfrazada de resultado técnico.

Este ataque pertenece a la familia de las inyecciones de prompt. El problema aparece porque los modelos de lenguaje tratan muchos textos como posibles instrucciones. Por eso pueden confundirse al leer páginas web, correos o resultados de herramientas.

Los investigadores llamaron a la técnica inyección de contexto criptográfico. Su hipótesis es que las defensas de Grok revisaban el texto visible, pero no inspeccionaban bien lo que el propio sistema generaba al descifrar. xAI fue avisada en junio y, al publicarse el caso el 20 de agosto de 2026, la prueba seguía funcionando.

Basado en: Dan Goodin, Ars Technica