Los más veraces: un ranking de los modelos de IA
Fuente: Ciberpolítica
Hemos vuelto del verano con un dato importante: hacemos ranking de los más fiables modelos de Inteligencia Artificial, particularmente en lo relativo a noticias de actualidad. En general la falsedad va en aumento en unos modelos que se niegan a quedarse callados cuando no saben la respuesta (como muchos humanos). Hay varias explicaciones, pero una preocupante tiene que ver con los tentáculos del ecosistema desinformativo ruso, la red PRAVDA (antes llamada Portal Kombat).
¡Feliz Juevinfo para todos!
🏆 El ranking de los modelos de IA
Según los datos del informe de NewsGuard, que salió a la luz pública en agosto 2025, hemos construido, con la ayuda de Chat GPT, un ranking de los 8 principales chatbots de IA en función de la menor proporción de respuestas con afirmaciones falsas (es decir, los más “fiables” en temas de noticias actuales).
- Claude – ~10 % de afirmaciones falsas
🔹 El más fiable del grupo.
🔹 Se mantiene más prudente y menos propenso a inventar o tomar desinformación como cierta. - Gemini – ~16,7 %
🔹 Segundo lugar, con un desempeño bastante estable.
🔹 Se beneficia de filtros más fuertes contra información no verificada. - Copilot (Microsoft) – ~36,7 %
🔹 Es el tercero, pero ya con un salto grande en errores.
🔹 Su integración con Bing expone más a fuentes poco fiables. - Mistral – ~36,7 %
🔹 Similar a Copilot, aunque menos consistente en multilingüismo.
🔹 Su modelo ligero lo hace más vulnerable a desinformación localizada. - ChatGPT (OpenAI) – ~40 %
🔹 Retrocede respecto al año anterior.
🔹 Aunque responde con seguridad, se arriesga más a citar afirmaciones erróneas. - Meta (Llama) – ~40 %
🔹 Nivel similar a ChatGPT, con tendencia a repetir bulos detectados en redes sociales. - Perplexity – ~46,7 %
🔹 Muy expuesto por su integración intensiva con búsqueda en vivo.
🔹 A veces cita fuentes que en realidad desmienten la afirmación que presenta. - Pi (Inflection) – ~56,7 %
🔹 El peor evaluado en el informe.
🔹 Más de la mitad de sus respuestas en temas sensibles contenían desinformación.
Es llamativo que no aparezca aquí Grok, y es que Grok (de xAI) está mencionado en el informe, pero sin cifras concretas compartidas que permitieran posicionarlo con certeza. Algo similar ocurre con Smart Assistant (You.com). Sin embargo, el informe proporciona datos que no dejan bien parado a Grok respecto a la veracidad de las noticias geopolíticas de actualidad:
- En el contexto del conflicto Israel-Irán, un estudio del DFRLab encontró que Grok ofrecía respuestas contradictorias sobre si ciertos videos eran reales o no, identificando erróneamente ubicaciones o fuentes. AL-Monitor
- En ese mismo estudio, Grok repitió afirmaciones falsas pronunciadas por redes como Pravda. AL-Monitor, haciéndose parte de los esfuerzos de Desinformación rusa, con el “Pravda network”. En marzo de 2025, uno de los informes de NewsGuard analizó cómo los 10 principales chatbots (incluyendo Grok) repetían narrativas falsas creadas por la red Pravda unos 33 % de las veces.
Más preocupante aún que la proporción de respuestas equivocadas es el hecho que la tasa de información falsa proporcionada por los 10 modelos de IA generativa más extendidos se haya duplicado en un año. Ha pasado del 17% al 35%, en promedio, y más aún entre los modelos más populares. El siguiente gráfico, hecho con ChatGPT a partir de los datos del artículo lo demuestra (OJO, he revisado que los datos del gráfico sean los correctos, pues en estos casos el ojo del amo-humano engorda al caballo…)
Hemos incluido estimaciones para Grok y Smart Assistant

📊 Un análisis de Carmela Ríos
En su cuenta de LinkedIn analiza Carmela Ríos este informe, respecto al deterioro de la fiabilidad de los principales modelos generativos de lenguaje. ¿Qué ha pasado en este tiempo?
1 – Los modelos de IA han integrado las búsquedas en Internet en tiempo real. De esta forma siempre te responden (de tasa de “no respuesta” de un 31% han pasado a un 0% pero al buscar en un espacio informativo cada vez más contaminado, el número de informaciones falsas se ha disparado.
2 – Según el estudio, los modelos de IA buscan la información allá donde se encuentre. Si los únicos datos que existen proceden de fuentes de baja calidad, da igual. Es la oportunidad que están buscando los actores geopolíticos de la desinformación (Rusia es la maestra) para inundar Internet con sus propias aportaciones.
3 – Esta es la razón por la que los modelos de IA tienen a rebotar información falsa sobre temas de actualidad. Lo que parecían “disfunciones aisladas son en realidad “vulnerabilidades estructurales en la forma en que los modelos generativos de IA procesan noticias e información”, dice el informe.
4 – Houston, houston, tenemos un problema. Si nada lo remedia, los modelos de IA se transforman en un altavoz adicional de la desinformación en lugar de un filtro o un canal más de verificación. Un propulsor de polarización más en el contexto de una campaña electoral, por ejemplo.
Habrá, por tanto, que afinar las técnicas de búsquedas con IA, diversificando fuentes, usos y modos de búsqueda. Aburrirnos, no nos vamos a aburrir…
Leer el informe completo
El network de Pravda (o el diablo viste de Pravda)
El artículo “The Pravda Network” del Digital Forensic Research Lab (DFRLab) y la empresa finlandesa Check First documenta una operación de desinformación rusa conocida como la “Red Pravda”, anteriormente denominada “Portal Kombat”. Esta red se compone de cientos de sitios web que simulan ser medios de comunicación legítimos, pero que en realidad amplifican narrativas pro-Kremlin. Su actividad se ha incrementado desde el 24 de febrero de 2022, con un notable aumento en la difusión de contenido en plataformas como Wikipedia, X (anteriormente Twitter) y chatbots de inteligencia artificial.
La investigación revela que la Red Pravda ha publicado más de 5 millones de artículos (dato actualizado), reutilizando contenido de medios rusos sancionados y canales de Telegram cuestionables. Estos artículos se distribuyen en múltiples idiomas y regiones, incluyendo Europa, África y Asia, con un enfoque inicial en países como Polonia, Alemania y Francia desde el verano de 2023. Además, la operación está vinculada a la empresa de TI TigerWeb, con sede en Crimea, cuyos propietarios mantienen conexiones con el gobierno respaldado por Rusia en la región.
Aquí puede observarse el complejo ecosistema de pseudomedios de la red Pravda que intoxica el espacio público digital y en buena medida explican el incremento reciente en los fallos de los modelos generativos de lenguaje

Para monitorear esta actividad, se ha desarrollado un muy completo panel interactivo que ofrece datos en tiempo real sobre los sitios web asociados a la Red Pravda, permitiendo analizar métricas como el número de artículos publicados, su distribución temporal y las fuentes citadas. Este recurso está disponible públicamente en el sitio web de Check First.
Leer completo en DFRLAb






