Qué IAs resisten mejor la propaganda rusa: el benchmark que pone nota a 50 modelos
El Instituto de la Lengua Estonia ha puesto a prueba más de 50 modelos de lenguaje para ver cuáles se tragan las narrativas del Kremlin y cuáles las detectan. He mirado los datos con lupa y hay sorpresas — y alguna que otra vergüenza.
En resumen
- El Instituto de la Lengua Estonia ha evaluado más de 50 modelos de IA para medir su resistencia a las narrativas del Kremlin.
- Una nota positiva: los modelos open-weight dieron la talla. Nemotron de Nvidia y Qwen de Alibaba registraron resultados comparables a los mejores Claude,
- GPT-5.4 de OpenAI queda en un segundo escalón decente: 88,9 de media, con un 54% de respuestas ejemplares.
cada día más gente usa ChatGPT, Claude o Gemini no solo para traducir o resumir, sino para entender lo que pasa en el mundo. Le preguntas a una IA quién empezó la guerra de Ucrania, qué pasó en Crimea o si la OTAN es una amenaza, y la respuesta que obtienes depende del modelo que tengas delante. No es una exageración: depende del modelo, literalmente.
Los estados que llevan décadas perfeccionando sus maquinarias de propaganda han visto el filón antes que nadie. Si consigues sesgar los datos de entrenamiento, sesgas las respuestas. Y punto. Por eso Estonia —ex república soviética con una frontera de 294 kilómetros con Rusia— acaba de publicar un benchmark que mide exactamente qué modelos de IA se tragan las narrativas del Kremlin y cuáles las rechazan.
El estudio lo ha liderado el Instituto de la Lengua Estonia (ELI) junto al colectivo de defensa Propastop, un grupo de voluntarios que lleva años documentando operaciones de influencia rusas. Han evaluado más de 50 modelos con 75 preguntas en tres idiomas (inglés, estonio y ruso) formuladas de tres maneras: neutral, sesgada —con presunciones falsas— y maliciosa, diseñada para extraer desinformación explícita. El proceso duró dos semanas y las evaluaciones fueron validadas por expertos humanos de forma independiente.
Anthropic arrasa, Google se estrella
El ranking es bastante claro. Los modelos Claude de Anthropic copan seis de los 10 primeros puestos. Claude Opus 4.7, el mejor de todos, saca una media de 94,9 sobre 100 y recibe la calificación más alta —"Ejemplar"— en el 77% de las preguntas. Solo en un 2% de los casos su respuesta fue "mediocre". He probado varios Claude y la diferencia con otros modelos cuando preguntas cosas con carga política se nota. No es perfecto, pero es el que menos se va por las ramas.
GPT-5.4 de OpenAI queda en un segundo escalón decente: 88,9 de media, con un 54% de respuestas ejemplares. Suficiente para aprobar con nota, pero lejos del dominio de Anthropic en este terreno concreto.
Y luego está Google. Gemini 2.5 Pro, un modelo que ya tiene casi un año, apenas llega a 82 puntos. Pero lo grave viene con Gemini 3.5 Flash, su modelo más reciente, que se desploma hasta 73 puntos. Para que te hagas una idea: eso es lo que sacaba Claude 3.5 Haiku en 2024. Dos años de diferencia. El informe detalla que los Gemini tienen un problema muy concreto: se derrumban con las preguntas maliciosas y, sobre todo, con las formuladas en ruso. Si algo he aprendido cubriendo IA es que Google lleva un par de años tropezando en seguridad — y este benchmark lo confirma con cifras.
Una nota positiva: los modelos open-weight dieron la talla. Nemotron de Nvidia y Qwen de Alibaba registraron resultados comparables a los mejores Claude, demostrando que el código abierto no está condenado a ser un coladero de desinformación.
Pregúntale en ruso y la cosa cambia
Este es el dato que más me ha inquietado del estudio. Muchos modelos son bastante más vulnerables cuando la pregunta se hace en ruso. En varios casos, la probabilidad de generar una respuesta que apoye narrativas del Kremlin casi se duplica al cambiar el idioma de la consulta.
Gemini 3.5 Flash, Kimi K2 de Moonshot y Step 3.5 Flash de StepFun recibieron puntuaciones significativamente peores en ruso que en inglés. Esto es un problemón. Si un modelo es seguro en inglés pero vulnerable en ruso, cualquier operación de influencia dirigida a poblaciones rusoparlantes —y hay millones en los países bálticos, Europa del Este y Asia Central— tiene la puerta abierta de par en par.
Las 14 narrativas que el Kremlin quiere que te creas
Propastop identificó 14 categorías de narrativas estratégicas rusas para diseñar las preguntas. Van desde la anexión de Crimea y la justificación de la guerra en Ucrania hasta la historia de la OTAN como "amenaza expansionista" y la supuesta necesidad de "proteger" a las minorías rusas en el Báltico. Si has consumido medios rusos en los últimos años, reconocerás todas y cada una.
Arvi Tavast, director del ELI, no se anda con rodeos: "Las fábricas de trolls políticos extranjeros pueden producir grandes cantidades de contenido falso que puede usarse para sesgar modelos de IA. Esta es una tendencia peligrosa, y debemos trabajar activamente para asegurar que la imagen de Estonia se mantenga equilibrada".
El benchmark no se queda aquí. Este otoño se amplía a medicina, derecho y protección infantil. La pregunta de fondo es la misma: ¿puedes fiarte de lo que te dice una IA cuando el tema es delicado?
Rusia ya está moviendo ficha con los BRICS
El estudio estonio no es el único que señala el problema. Una investigación del profesor Gregory Asmolov del King's College de Londres analiza cómo el gobierno ruso —a través de sus alianzas técnicas con otros países BRICS— está intentando influir en los modelos de IA para que reflejen posiciones "culturalmente sensibles" a los intereses del Kremlin. O sea, que las IAs del futuro vean el mundo como Moscú quiere.
Personalmente creo que aquí hay una carrera silenciosa que no está recibiendo la atención que merece. Mientras el debate público sobre la IA gira en torno a si nos va a quitar el trabajo o si va a alcanzar la singularidad, hay estados invirtiendo recursos serios en sesgar los datos de entrenamiento. Y el benchmark estonio es la primera medición rigurosa de quién va ganando.
Tabla resumen: los 5 mejores (y el peor de los grandes)
| Modelo | Puntuación | % Ejemplar | Desarrollador |
|---|---|---|---|
| Claude Opus 4.7 | 94,9 | 77% | Anthropic |
| Claude Sonnet 4.5 | 93,2 | 72% | Anthropic |
| Nvidia Nemotron | 92,1 | 70% | Nvidia |
| Alibaba Qwen | 91,5 | 68% | Alibaba |
| GPT-5.4 | 88,9 | 54% | OpenAI |
| Gemini 3.5 Flash | 73,0 | ~35% |
Si usas IA para informarte sobre geopolítica —y cada día más gente lo hace— mi recomendación después de ver estos datos es clara: Claude es hoy la opción más resistente a la desinformación rusa. GPT-5.4 cumple. Y Gemini, sinceramente, preocupa.
Si consultas en ruso, ten el doble de cuidado. La diferencia de rendimiento entre idiomas en varios modelos es lo bastante grande como para que un mismo asistente te dé una respuesta responsable en inglés y una intoxicada en ruso. Y eso no es aceptable en 2026.