Periodista logró engañar a ChatGPT y Gemini: El truco para que las IA cuenten mentiras

Mauro Cubaque

 

De acuerdo con Thomas Germain, le tomó esperar tan solo 2 horas demostrar que con un método sencillo, y que expertos en SEO y mercadeo, se puede manipular las respuestas de ChatGPT y Google, haciendo que la inteligencia artificial mienta sin control.


Thomas Germain


En un artículo publicado en la BBC, se logró demostrar lo sencillo que es lograr la Manipulación de las IA y el riesgo de las noticias falsas digitales: así logré que los chatbots más potentes del mundo dijeran que soy un campeón comiendo hot dogs, dice su artículo.


El fascinante mundo de la inteligencia artificial generativa nos ha prometido una era de conocimiento infinito, pero la realidad es mucho más frágil y cómica de lo que los gigantes de Silicon Valley admiten. Recientemente, un experimento reveló que engañar a los sistemas más avanzados, como ChatGPT y Gemini, es tan sencillo que parece un juego de niños, poniendo en entredicho la seguridad de la información que consumimos a diario. Al redactar un simple artículo falso en un blog personal, es posible inyectar datos erróneos en el flujo de búsqueda de estas herramientas, logrando que repliquen mentiras con una confianza absoluta y alarmante.


Esta vulnerabilidad no solo afecta a temas triviales como récords absurdos de comida, sino que se extiende a áreas críticas como la salud y las finanzas personales, donde la desinformación puede tener consecuencias fatales. La rapidez con la que estas empresas lanzan sus productos ha superado con creces su capacidad para regular la veracidad de lo que sus algoritmos "aprenden" de la red. Lo que antes tomaba años de técnicas complejas de posicionamiento, hoy se resume en una entrada de blog bien estructurada que la IA toma como verdad absoluta.


¿Es posible hackear la inteligencia artificial con una simple publicación?

La respuesta corta es un rotundo sí, y el proceso es sorprendentemente rudimentario para los estándares tecnológicos actuales. El periodista Thomas Germain demostró que dedicando apenas 20 minutos a escribir un artículo ficticio sobre "los mejores periodistas tecnológicos comiendo hot dogs", pudo doblegar la voluntad de los algoritmos de Google y OpenAI. En menos de 24 horas, las herramientas de búsqueda de IA estaban citando su sitio web como la fuente oficial de un campeonato que nunca existió, elevándolo al puesto número uno de una disciplina inexistente.


Este fenómeno ocurre porque muchos chatbots, al no encontrar información en su base de datos de entrenamiento, realizan búsquedas en tiempo real en internet. Es en este punto donde se crean los llamados "vacíos de datos" o data voids, espacios donde hay tan poca información sobre un tema que cualquier contenido nuevo, por falso que sea, es absorbido y procesado como un hecho. Google ha admitido que cerca del 15% de las búsquedas diarias son completamente nuevas, lo que crea un campo de juego perfecto para que los spammers manipulen los resultados.


Mientras que el buscador tradicional de Google tiene décadas de filtros contra el spam, la capa de IA parece haber retrocedido a los estándares de seguridad de principios de los años 2000. La facilidad con la que se puede posicionar una mentira es tal que los expertos en SEO lo llaman un "Renacimiento para los spammers". El riesgo real es que el usuario promedio tiende a confiar ciegamente en la respuesta directa de la IA, sin molestarse en verificar la fuente original, algo que antes era obligatorio al navegar por una lista de enlaces.


La manipulación no se detiene en los blogs personales; los actores malintencionados están utilizando servicios de distribución de notas de prensa y contenido patrocinado para dar una pátina de legitimidad a sus engaños. Al aparecer en sitios con mayor autoridad, la IA integra estos datos con mayor rapidez y menor escepticismo. Es una carrera armamentista donde los desarrolladores de IA están priorizando las ganancias y el dominio del mercado sobre la integridad de los datos y la seguridad del usuario final.


Los peligros de la desinformación en temas de salud y dinero

Cuando pasamos de las bromas sobre hot dogs a temas de "vida o muerte", el panorama se vuelve oscuro rápidamente. Se ha detectado que marcas de productos no regulados, como gomitas de cannabis, han logrado que la IA de Google Overview extraiga afirmaciones falsas sobre la ausencia de efectos secundarios. Esto es extremadamente peligroso, ya que estos productos tienen riesgos conocidos y pueden interactuar de forma negativa con medicamentos reales, algo que la IA omite por completo al priorizar la fuente manipulada.


El impacto en las finanzas no es menor; búsquedas sobre clínicas de trasplante capilar o inversiones en oro para el retiro están siendo dominadas por resultados generados mediante técnicas de manipulación de chatbots. Estas respuestas no son consejos objetivos, sino publicidad encubierta que la IA presenta con un tono autoritario y servicial. La capacidad de distinguir entre un hecho verificado y un anuncio pagado se está diluyendo, dejando al usuario en una posición de vulnerabilidad sin precedentes.


La tecnología de los modelos de lenguaje extenso (LLM) tiene un problema intrínseco de confianza: siempre entregan sus respuestas con la misma seguridad, ya sea que hablen de la Segunda Guerra Mundial o de una mentira inventada hace diez minutos. Esta falta de matices en el tono es lo que facilita el engaño. Al no haber una advertencia clara de que la información proviene de una única fuente no verificada, el usuario asume que la empresa tecnológica respalda la veracidad de lo dicho.


Para combatir esto, algunos expertos sugieren que las herramientas de IA deberían incluir avisos mucho más prominentes sobre la naturaleza experimental de sus respuestas. Además, deberían ser transparentes cuando solo existe una fuente disponible para un dato específico. Sin embargo, mientras el modelo de negocio sea la rapidez y la captura de la atención del usuario, es poco probable que veamos restricciones que ralenticen la experiencia de uso, aunque eso signifique propagar falsedades.


La responsabilidad recae, una vez más, en el "ciudadano digital". No debemos permitir que el pensamiento crítico se oxide ante la comodidad de una respuesta rápida. Verificar quién escribió la información, cuántas fuentes coinciden y qué intereses podría haber detrás es hoy más vital que nunca. ¿Estamos preparados para un futuro donde la verdad dependa de quién publica el último post en un rincón olvidado de la red?


¿Cómo podemos protegernos de las alucinaciones de la IA?

La mejor defensa es el escepticismo informado: si una IA te da un dato específico sobre un negocio local, una directriz médica o una regla legal, lo más prudente es dudar por defecto. Estas herramientas son excelentes para temas de cultura general o hechos históricos establecidos, pero fallan estrepitosamente en información sensible al tiempo o muy nicho. Siempre busca el botón de fuentes, revisa cuántos enlaces respaldan la respuesta y desconfía si todos los caminos llevan a un mismo sitio desconocido.


Es fundamental entender que la IA no "sabe" cosas, sino que predice la siguiente palabra basándose en patrones de datos. Si el patrón que encuentra está viciado por spam, el resultado será spam. La industria tecnológica está trabajando en soluciones, pero el parche siempre llegará después de la herida. Mientras tanto, la vigilancia personal y el uso de fuentes tradicionales de confianza siguen siendo las herramientas más potentes contra el caos informativo. ¿Llegará el día en que los chatbots admitan que simplemente no saben la respuesta?


Preguntas Frecuentes sobre la Manipulación de IA

+ ¿Cómo logran engañar a ChatGPT y Google tan fácil?

Aprovechando los 'vacíos de datos'. Si escribes sobre un tema inexistente en un blog personal, la IA lo toma como la única fuente disponible y lo replica como verdad.

+ ¿Qué riesgos reales tiene este tipo de engaño?

Puede manipular información sobre salud, consejos financieros y decisiones de voto, haciendo que las personas tomen decisiones basadas en mentiras peligrosas.

+ ¿Por qué la IA no detecta que el contenido es falso o satírico?

Porque los modelos de lenguaje priorizan la estructura del texto y su relevancia aparente sobre la verificación de hechos externos en tiempo real.

+ ¿Qué puedo hacer para no ser engañado por una IA?

Verifica siempre las fuentes que cita el chatbot, usa el pensamiento crítico y no tomes consejos médicos o legales de un chatbot sin consultar a un experto humano.

Evidencias de Manipulación

Tema del Engaño Herramienta Afectada Resultado
Récord de Hot Dogs ChatGPT / Gemini Mentira aceptada
Salud (Cannabis) Google Overview Datos peligrosos

#buttons=(Ok, entiendo!) #days=(20)

Usamos cookies para mejorar tu experiencia de navegación. Más Info
Ok, Go it!