Los chatbots de IA manejaron la propaganda extranjera mejor que los motores de búsqueda en una nueva prueba
NPR y NewsGuard formularon 30 preguntas basadas en falsedades difundidas por el estado a seis chatbots y cuatro motores de búsqueda. Los chatbots los desacreditaron aproximadamente las tres cuartas partes de las veces. Los resúmenes de IA encima de los resultados de búsqueda obtuvieron peores resultados.
Los investigadores han estado preocupados durante años de que la propaganda estatal envenenara las respuestas de la IA. Un nuevo experimento sugiere que el panorama es más heterogéneo y, en una dirección, más alentador de lo esperado. NPR trabajó con NewsGuard, una empresa que califica la confiabilidad de las fuentes de noticias, para probar cómo seis populares chatbots y cuatro motores de búsqueda manejan las falsedades difundidas por China, Irán y Rusia. Los chatbots desacreditaron las afirmaciones falsas aproximadamente las tres cuartas partes de las veces y obtuvieron mejores resultados que los simples resultados de búsqueda. Los resúmenes de IA que ahora se encuentran en la parte superior de muchas páginas de búsqueda obtuvieron peores resultados que ambos.
La configuración fue sencilla. NewsGuard seleccionó 15 narrativas falsas que circularon entre diciembre de 2025 y julio de 2026, luego escribió dos preguntas para cada una: una neutral (“¿sucedió esto?”) y otra que asumía que la historia falsa era cierta (“¿por qué sucedió esto?”). Las 30 preguntas fueron dirigidas a ChatGPT, Gemini, Microsoft Copilot, Meta AI, Grok y Claude, todos con acceso web, y a Google, Bing, DuckDuckGo y Yandex. Un ejemplo: después de que Rusia bombardeara un histórico monasterio ucraniano en junio, cuentas pro Kremlin afirmaron que Ucrania lo había hecho. Todos los chatbots captaron la premisa falsa y Gemini mencionó la afirmación como parte de una campaña de desinformación rusa. Los resultados variaron mucho entre los resúmenes de búsqueda: la descripción general de la IA de Google fue desacreditada la mayor parte del tiempo, los resúmenes de Bing fallaron la mayor parte del tiempo y DuckDuckGo quedó en el medio. Claude de Anthropic mostró un patrón específico digno de mención, ya que fuentes alineadas con el estado aparecieron con más frecuencia en las respuestas en las que fracasó que en aquellas en las que tuvo éxito. Google cuestionó la metodología, diciendo que las consultas son raras y que algunas respuestas “fallidas” aún proporcionaban un contexto útil.
Qué está pasando realmente aquí: un chatbot con acceso web hace algo que una lista de enlaces azules no puede hacer. Puede sopesar de dónde proviene un reclamo y decirlo, a veces en varios idiomas a la vez. Por eso es mejor que la búsqueda en esta tarea tan limitada. Pero el mismo estudio señala el límite. Un artículo separado de la Universidad de Washington en St. Louis encontró que aproximadamente 1 de cada 9 afirmaciones fácticas individuales en las Reseñas de IA de Google no estaban respaldadas por las fuentes citadas a continuación. Y los investigadores descubrieron que las herramientas de inteligencia artificial empeoran exactamente donde más las necesitas, cuando abundan las fuentes cuestionables y las confiables son escasas. Un estudio en Nature también encontró que preguntar sobre el gobierno de China en chino producía respuestas más favorables que preguntar lo mismo en inglés, un patrón que se repite en otros países con medios de comunicación estrictamente controlados.
Qué significa esto para usted: si está revisando un reclamo que vio en línea, comenzar con un chatbot que pueda buscar en la web es un primer paso razonable, mejor que escanear los resultados de la búsqueda y mejor que confiar en el resumen de IA en la parte superior de la página. Luego haga lo único que recomiendan todos los expertos del estudio. Pregunta de nuevo. El investigador de alfabetización digital Mike Caulfield descubrió que un simple seguimiento, del tipo “mirar la evidencia y las fuentes, luego resumir”, mejora de manera confiable la segunda respuesta. Después de eso, abra usted mismo la fuente principal. El resumen del chatbot es un punto de partida para la investigación, no el final.
Fuentes
- Probamos cómo los chatbots de IA manejarían la propaganda extranjera. Lo hicieron sorprendentemente bien (NPR)
- ¿Son fiables las descripciones generales de la IA? Evaluación del nivel de reclamación de los resultados de búsqueda de IA (arXiv)
- El lenguaje da forma a lo que los grandes modelos lingüísticos dicen sobre los gobiernos (Nature)
Fuentes: https://www.npr.org/2026/08/30/nx-s1-5876436/chatbots-search-propaganda
Un tribunal australiano pronto le hará declarar si utilizó IA
Un trabajador de ALDI despedido fue condenado a pagar parte de los costos legales de su empleador después de confiar en AI como cuasi asesor legal. A partir del 20 de octubre, todas las personas que presenten declaraciones ante la Fair Work Commission de Australia deben revelar el uso de la IA y verificar lo que produjo.