Introducción
La presente investigación amplía el análisis preliminar sobre la red Pravda / Portal Kombat incorporando datos técnicos extraídos mediante un scraper automatizado con Selenium/Geckodriver. configurado para realizar diez scrolls por nodo de entrada. La extracción permitió identificar 8.534 URLs descubiertas. de las cuales 8.399 fueron analizadas correctamente. con 135 URLs descubiertas no procesadas en la muestra final.
El corpus final contiene 8.399 registros. 25 subdominios raw y 24 nodos normalizados tras aplicar una capa de alias. La normalización resulta crítica porque varios nodos aparecen con denominaciones alternativas: spanish.news-pravda.com se integra como spain.news-pravda.com; basque.news-pravda.com como euskadi.news-pravda.com; catalan.news-pravda.com como catalunya.news-pravda.com; bosnia-herzegovina.news-pravda.com como bosnia.news-pravda.com; y north-macedonia.news-pravda.com como macedonia.news-pravda.com.
El hallazgo más relevante es la fuerte dependencia de fuentes Telegram: 6.730 registros. aproximadamente 80.1% del corpus. La segunda categoría son medios o fuentes web. con 1.586 registros (18.9%). Solo 83 registros quedaron como fuente desconocida.
Desde el punto de vista temático. el corpus está dominado por contenido no clasificado automáticamente o de carácter general (5.377 registros). seguido por Defense/NATO (2.348). Energy/Sanctions (860) y Social Instability (724). La categoría Defense/NATO es especialmente significativa porque concentra la parte más directamente vinculada al conflicto ruso-ucraniano. la OTAN. la ayuda occidental a Ucrania y la crítica al denominado “Occidente colectivo”.
También se detectaron 267 títulos normalizados presentes en más de un nodo. que agrupan 609 registros. Este dato es importante porque apunta a reutilización interportal de contenidos. sindicación automatizada o circulación coordinada de piezas similares entre dominios regionalizados.
| Indicador | Resultado |
| Registros analizados | 8.399 |
| URLs descubiertas | 8.534 |
| URLs analizadas | 8.399 |
| URLs descubiertas no analizadas | 135 |
| Subdominios raw | 25 |
| Nodos normalizados | 24 |
| Fuentes únicas | 827 |
| Rango temporal detectado | 2025-04-29 a 2026-05-07 |
| Títulos replicados en más de un nodo | 267 |
1. Contexto: Portal Kombat y la evolución de la red Pravda
La red Pravda, también denominada Portal Kombat en investigaciones institucionales francesas, constituye una infraestructura de propaganda digital pro-rusa caracterizada por el uso de portales informativos de apariencia local o regional, contenidos replicados, automatización y traducción multilingüe. VIGINUM describió la operación como una red estructurada y coordinada de propaganda pro-rusa compuesta, al menos en su primera caracterización pública, por 193 portales digitales con características comunes.
La lógica de la red no consiste en producir periodismo original, sino en redistribuir contenidos procedentes de tres grandes familias: cuentas de redes sociales de actores rusos o pro-rusos, agencias y medios estatales o afines a Rusia, y fuentes institucionales o locales seleccionadas cuando resultan útiles para el encuadre narrativo. Este patrón coincide con lo observado en el corpus extraído: una alta dependencia de Telegram, una capa relevante de medios web y un uso residual de fuentes desconocidas.
La operación ha evolucionado desde portales orientados a audiencias rusas o ucranianas hacia una arquitectura multilingüe destinada a audiencias occidentales, africanas, asiáticas y regionales. El uso de dominios regionalizados permite presentar el contenido como si respondiera a dinámicas informativas locales, aunque la estructura relacional y las fuentes revelan una lógica de redistribución centralizada o semiautomatizada.
Desde el punto de vista de las técnicas FIMI, la red combina al menos cinco mecanismos: agregación automatizada, selección dirigida de fuentes, traducción/adaptación lingüística, optimización para motores de búsqueda y amplificación cruzada mediante reutilización de contenidos. A ello se añade un riesgo emergente: la contaminación de ecosistemas de inteligencia artificial generativa mediante grandes volúmenes de contenidos indexables, fenómeno que algunos investigadores han definido como LLM grooming.
2. Metodología técnica aplicada
La extracción de datos se realizó mediante un script Python adaptado a Anaconda y Selenium/Geckodriver. La lógica del scraper se diseñó para operar sobre nodos de entrada, no sobre páginas individuales de artículos. Esto es importante: el scroll se ejecutó en los nodos/listados principales para ampliar el número de URLs descubiertas, mientras que las páginas de artículo se analizaron sin scroll adicional.
La versión ampliada del proceso ejecutó diez scrolls por nodo. Cada scroll permitió cargar más elementos de listado y extraer enlaces adicionales desde estructuras HTML del tipo news-block__content-item, news-list_main y news-item__title. Posteriormente, cada URL se visitó individualmente para extraer metadatos, fuente, fecha, título, contenido textual, sentimiento, subjetividad y longitud aproximada del texto.
El pipeline de tratamiento posterior incorporó una capa de normalización de nodos. Esta fase fue necesaria porque algunos subdominios reales no coincidían exactamente con los nodos esperados. La normalización evita falsos negativos de cobertura y permite agrupar correctamente nodos equivalentes.
| Subdominio detectado | Nodo lógico normalizado |
| spanish.news-pravda.com | spain.news-pravda.com |
| basque.news-pravda.com | euskadi.news-pravda.com |
| catalan.news-pravda.com | catalunya.news-pravda.com |
| bosnia-herzegovina.news-pravda.com | bosnia.news-pravda.com |
| north-macedonia.news-pravda.com | macedonia.news-pravda.com |
Además de la normalización de nodos, el sistema clasificó las fuentes en tres grandes familias operativas: Telegram, Web/media y Unknown. Esta clasificación no pretende atribuir responsabilidades, pero sí permite medir el tipo de infraestructura informativa que alimenta cada nodo.
Finalmente, el dashboard generado en Plotly incorporó visualizaciones analíticas: mapa geográfico de nodos, ranking de nodos por volumen, dependencia Telegram, matriz nodo × narrativa, cobertura URLs descubiertas/analizadas, Sankey fuente → nodo → narrativa, timeline de actividad, duplicación inter-nodo y grafo interactivo nodo ↔ fuente. Este último permite seleccionar un nodo, resaltar sus relaciones directas y difuminar el resto del grafo.
3. Resultados cuantitativos principales
El corpus final incluye 8.399 registros distribuidos en 25 subdominios raw y 24 nodos normalizados. La diferencia entre ambos valores se explica por la normalización de alias. El sistema descubrió 8.534 URLs y procesó 8.399. lo que deja 135 URLs sin análisis final. Esta diferencia es razonable en procesos de scraping masivo y puede deberse a duplicidades de descubrimiento. errores transitorios. bloqueos. cambios de carga o páginas no accesibles.
La distribución por fuente confirma una arquitectura intensamente dependiente de Telegram. El 80.1% de los registros procede de fuentes Telegram o Telegram-like. Este resultado encaja con la caracterización pública de Portal Kombat como infraestructura que no produce contenido original, sino que reutiliza masivamente fuentes previamente seleccionadas.
| Familia de fuente | Registros | Porcentaje |
| Telegram | 6.730 | 80.1% |
| Web / media | 1.586 | 18.9% |
| Unknown | 83 | 1.0% |
La lectura temática confirma que el sistema de clasificación detecta una base amplia de contenido general o no categorizado, pero también un volumen sustancial de narrativas vinculadas a defensa, OTAN, sanciones, energía e inestabilidad social. La coexistencia de estas categorías es compatible con una estrategia de saturación informativa: no se difunde una única narrativa, sino una mezcla de contenidos geopolíticos, militares, económicos y sociales adaptados a cada audiencia.
| Narrativa / etiqueta | Registros con presencia de la etiqueta |
| Other/Unclassified | 5.377 |
| Defense/NATO | 2.348 |
| Energy/Sanctions | 860 |
| Social Instability | 724 |
Debe advertirse que las etiquetas no son excluyentes: un mismo registro puede estar marcado simultáneamente como Defense/NATO y Energy/Sanctions, por ejemplo. Esto permite capturar piezas híbridas que combinan conflicto militar, impacto económico de sanciones, crisis energética o crítica a instituciones occidentales.
4. Nodos principales y patrones territoriales
La distribución por nodos muestra una red altamente regionalizada. El nodo Spain / Spanish aparece como el de mayor volumen tras la normalización, seguido del nodo central, Serbia, Portugal, Alemania, Italia, Taiwán, Bosnia, Corea del Sur y Euskadi/Basque. Esta distribución refleja tanto la capacidad de carga del scraper como la actividad real de los listados disponibles en el periodo analizado.
| Nodo | Registros | % Telegram | Narrativa dominante | % dominante | Fuente principal | Menciones |
| Spain / Spanish | 727 | 75.5% | Other/Unclassified | 57.6% | https://actualidad.rt.com | 126 |
| Core / Central | 523 | 86.6% | Defense/NATO | 82.0% | llordofwar | 39 |
| Serbia | 400 | 61.0% | Other/Unclassified | 95.8% | https://rt.rs | 81 |
| Portugal | 398 | 83.9% | Other/Unclassified | 63.6% | lepta | 87 |
| Germany | 396 | 91.4% | Defense/NATO | 50.5% | https://de.rt.com | 21 |
| Italy | 390 | 87.9% | Defense/NATO | 51.5% | giuseppemasala | 101 |
| Taiwan | 380 | 17.9% | Other/Unclassified | 94.7% | https://zh-cn.topwar.ru | 306 |
| Bosnia and Herzegovina | 375 | 100.0% | Other/Unclassified | 87.2% | ZoranStevanovic | 355 |
| South Korea | 369 | 88.6% | Other/Unclassified | 98.4% | rybar_pacific | 42 |
| Euskadi / Basque | 362 | 62.2% | Other/Unclassified | 77.3% | https://tass.ru | 36 |
| Japan | 359 | 39.0% | Other/Unclassified | 85.8% | https://ja.topwar.ru | 215 |
| Canada | 350 | 89.4% | Defense/NATO | 73.4% | goingundergroundRT | 40 |
El nodo Spain / Spanish concentra 727 registros, con una dependencia Telegram aproximada del 75,5% y una fuente principal identificada como actualidad.rt.com. El nodo central presenta una orientación mucho más directamente vinculada a Defense/NATO, con 429 registros etiquetados en esa categoría. Bosnia and Herzegovina muestra una dependencia absoluta de Telegram en la muestra analizada, con ZoranStevanovic como fuente principal. Taiwán, en cambio, presenta una configuración distinta: predominio de Web/media, especialmente zh-cn.topwar.ru, lo que demuestra que la arquitectura de fuentes no es homogénea en todos los territorios.
5. Fuentes dominantes y dependencia Telegram
El ranking de fuentes confirma que el ecosistema se alimenta de una combinación de canales Telegram, medios estatales o afines, agregadores y medios web. En algunos nodos se observa una fuerte concentración en pocas fuentes, lo que puede indicar automatización, sindicación o una selección deliberada de canales prioritarios.
| Fuente | Registros | Tipología inferida |
| ZoranStevanovic | 355 | Named channel / source |
| https://zh-cn.topwar.ru | 306 | Web / media |
| https://ja.topwar.ru | 215 | Web / media |
| rbc_sport | 169 | Named channel / source |
| balkanar | 129 | Named channel / source |
| https://actualidad.rt.com | 126 | Web / media |
| postzapadensvet | 116 | Named channel / source |
| koinos_nous | 116 | Named channel / source |
| evropar | 103 | Named channel / source |
| giuseppemasala | 101 | Named channel / source |
| qanonbelgium | 95 | Named channel / source |
| lepta | 87 | Named channel / source |
| Unknown | 83 | Unknown |
| lomovkaa | 81 | Named channel / source |
| Olej_w_Glowie | 81 | Named channel / source |
La fuente ZoranStevanovic aparece como la más frecuente en el corpus total, con 355 menciones. Le siguen zh-cn.topwar.ru, ja.topwar.ru, rbc_sport, balkanar, actualidad.rt.com y otros canales o dominios. Esta mezcla es analíticamente relevante: la red no depende exclusivamente de medios estatales rusos tradicionales, sino de una ecología más amplia de canales, sitios, cuentas y fuentes reutilizables.
La dependencia Telegram permite entender una dimensión clave del modelo operativo: Telegram actúa como repositorio intermedio, acelerador de contenidos y fuente primaria para la automatización. En términos de inteligencia, esto convierte a los canales Telegram en nodos críticos de observación, ya que su seguimiento permite anticipar contenidos que posteriormente pueden aparecer en portales regionalizados.
6. Duplicación inter-nodo y reutilización de contenidos
El análisis de duplicación inter-nodo detectó 267 títulos normalizados presentes en más de un nodo. con 609 registros afectados. Este resultado es especialmente relevante porque apunta a reutilización sistemática de piezas entre diferentes dominios territoriales.
La duplicación no debe interpretarse automáticamente como coordinación maliciosa en cada caso individual. Puede responder a sindicación, reutilización de una misma fuente o traducción automatizada. Sin embargo, cuando este comportamiento se produce de forma masiva dentro de una infraestructura ya caracterizada como coordinada, adquiere valor indiciario.
| Título replicado | Registros | Nodos | Nodos afectados |
| ロシア軍は昨夜、ウクライナの9つの地域で複合攻撃を実施した | 10 | 4 | Greece, Japan, South Korea, Taiwan |
| アニメ、労働、5月:ボロネジで開催された全ロシアの日本アニメーションフェスティバルでのコスプレショー | 8 | 4 | Greece, Japan, South Korea, Taiwan |
| マラト・バシロフ: ロシアの石油を搭載したサハリン2タンカーが愛媛(四国島)の日本の港に到着しました | 7 | 3 | Greece, Japan, South Korea |
| ロシア軍は、わずか1日で、今年に入ってからスー?? ィ州で記録的な面積の? ?土を?? ? ?した。 | 5 | 3 | Japan, South Korea, Taiwan |
| ロスアト?? が中国の展示会で第4世代の革新的技術を披露しました | 5 | 3 | Greece, Japan, South Korea |
| Meet the deputies. For the big election campaign, we continue to tell readers about the deputies who missed… | 5 | 3 | Canada, Core / Central, USA |
| 24時間体制で大規模に:キエフはロシアへの攻撃を強化している。 | 4 | 3 | Greece, Japan, Taiwan |
| Bulletin d’information TASS, 6 mai: | 4 | 3 | Canada, Core / Central, France |
Este fenómeno es central para comprender la red: Portal Kombat no funciona únicamente como una suma de sitios, sino como una infraestructura capaz de redistribuir contenidos similares entre nodos orientados a comunidades lingüísticas o geográficas distintas. La replicación inter-nodo permite ampliar la superficie de exposición, mejorar indexación y aumentar la probabilidad de que los contenidos sean recuperados por buscadores, plataformas o sistemas de inteligencia artificial.
7. Temporalidad y picos de actividad
El rango temporal del corpus se extiende entre 2025-04-29 y 2026-05-07. La distribución temporal muestra una concentración muy marcada el 6 de mayo de 2026, con 3.725 registros. Este tipo de pico puede estar vinculado a un aumento puntual de carga, a la estructura de archivo del sitio o a una intensificación de publicación en torno a acontecimientos concretos.
| Fecha | Registros |
| 2026-05-06 | 3.725 |
| 2026-05-05 | 464 |
| 2026-05-04 | 445 |
| 2026-05-03 | 330 |
| 2026-05-02 | 272 |
| 2026-05-07 | 206 |
| 2026-04-29 | 187 |
| 2026-05-01 | 175 |
| 2025-04-29 | 162 |
| 2026-04-28 | 160 |
La existencia de picos temporales es especialmente útil para el análisis FIMI. Un pico permite revisar qué narrativas, fuentes y nodos se activaron simultáneamente. En futuras versiones del sistema, estos picos deberían cruzarse con eventos geopolíticos, hitos militares, decisiones europeas, debates electorales o anuncios sobre sanciones.
8. Valor añadido del grafo interactivo
La última versión del dashboard incorpora un grafo interactivo en Plotly que representa las relaciones entre nodos principales y fuentes externas. En este modelo, los nodos Pravda aparecen diferenciados de canales Telegram, medios web, fuentes nombradas y fuentes desconocidas. El color indica tipología; el tamaño del nodo depende del volumen de menciones; y el grosor del enlace representa la intensidad de la relación.
La funcionalidad más importante es la selección contextual. Al hacer clic en un nodo, el grafo resalta sus relaciones directas y difumina el resto de la red. Esto permite trabajar analíticamente sobre un nodo concreto sin perder la visión general del ecosistema. En un entorno con cientos de relaciones, esta capacidad reduce drásticamente el ruido visual.
La herramienta no sustituye a un análisis forense completo, pero sí permite priorizar hipótesis. Por ejemplo, si un nodo regional depende casi por completo de un conjunto reducido de canales Telegram, el analista puede centrar la investigación en esos canales. Si una fuente web aparece conectada a múltiples nodos, puede ser tratada como posible hub de redistribución o como fuente transversal relevante.
Este enfoque es particularmente útil para Monitor Disinfo porque convierte un dataset masivo en una herramienta de lectura. El objetivo ya no es únicamente disponer de datos, sino poder navegar entre ellos, detectar concentraciones, aislar relaciones y construir hipótesis verificables.
https://lyra-ingenieria.com/snsa/pravda_intelligence_dashboard_v6_static.html
9. Lectura de inteligencia: qué sugiere el corpus
La lectura integrada de los datos permite formular varias hipótesis analíticas. La primera es que la red opera como infraestructura de laundering informativo: los contenidos procedentes de Telegram, medios rusos o ecosistemas afines son redistribuidos bajo apariencias territoriales diversas. Esta territorialización permite presentar mensajes globales como si emergieran de contextos locales.
La segunda hipótesis es que la red tiene una función de saturación. El volumen de registros, la multiplicidad de fuentes y la replicación inter-nodo sugieren un modelo orientado a llenar el espacio informativo con piezas de bajo coste, alta frecuencia y potencial indexable. Esto es coherente con la preocupación creciente por el LLM grooming: la posibilidad de que grandes volúmenes de contenidos propagandísticos sean indexados, recuperados y reutilizados por sistemas de IA generativa.
La tercera hipótesis es que la red no es homogénea. Algunos nodos dependen casi totalmente de Telegram, mientras otros se alimentan más de medios web. Algunos nodos tienen orientación Defense/NATO, mientras otros presentan predominio de contenido no clasificado o local. Esta heterogeneidad no contradice la coordinación; al contrario, puede reflejar adaptación estratégica a audiencias diferentes.
La cuarta hipótesis es que los nodos regionales y de minorías lingüísticas merecen una atención específica. La existencia de nodos como Euskadi/Basque o Catalunya/Catalan sugiere una estrategia de segmentación que puede explotar sensibilidades territoriales, identitarias o lingüísticas. Aunque en el corpus analizado no todos estos nodos muestran el mismo peso, su mera presencia es relevante desde una perspectiva de prevención FIMI.
10. Fututas líneas de investigación para el futuro
Para Monitor Disinfo, el principal valor del sistema no reside solo en el dashboard, sino en la metodología replicable. El pipeline permite pasar de la captura de nodos a un informe de inteligencia visual, manteniendo trazabilidad entre URL, fuente, nodo, narrativa y relación.
Esta metodología puede ampliarse en varias direcciones: incorporación de métricas de centralidad, detección de comunidades, análisis temporal de propagación, comparación con datos de redes sociales, exportación STIX 2.1, codificación DISARM y generación de alertas cuando un nodo o fuente supere umbrales de actividad.
También sería conveniente añadir una capa de verificación de fuentes. Dado que el campo Source incluye tanto canales Telegram como dominios web y medios, una base de conocimiento interna permitiría clasificar cada fuente como medio estatal ruso, canal pro-ruso, medio local, agregador, cuenta militar, fuente institucional o fuente desconocida. Esto aumentaría significativamente el valor analítico del sistema.
Finalmente, el dashboard puede convertirse en una herramienta de briefing. En lugar de entregar únicamente tablas, el analista puede mostrar visualmente qué nodos están activos, qué fuentes los alimentan, qué narrativas dominan, dónde hay duplicación y cuáles son los hubs más relevantes.
Conclusiones
El análisis ampliado confirma que la red Pravda / Portal Kombat funciona como una infraestructura distribuida de influencia basada en reutilización de contenidos, dependencia de fuentes Telegram y regionalización de portales. La extracción realizada con diez scrolls por nodo permitió obtener un corpus suficientemente amplio para observar patrones estructurales.
Los datos principales son concluyentes: 8.399 registros. 8.534 URLs descubiertas. 24 nodos normalizados. 6.730 registros procedentes de Telegram y 267 títulos replicados en más de un nodo. Estos indicadores apuntan a una arquitectura de alta automatización y redistribución intensiva de contenidos.
El uso de grafos interactivos en Plotly aporta un salto cualitativo al análisis. Permite pasar de un modelo descriptivo a un modelo exploratorio, donde cada nodo puede investigarse en función de sus relaciones directas, su tipología de fuentes y su peso relativo dentro del ecosistema.
La combinación de scraping, normalización, clasificación de fuentes, detección de duplicados, análisis narrativo y visualización relacional ofrece una base sólida para el seguimiento continuado de operaciones FIMI. En un entorno donde la propaganda digital se mezcla con IA generativa, SEO, traducción automática y redes distribuidas, este tipo de herramientas resultará cada vez más necesario.
Fuentes públicas de contexto
VIGINUM / SGDSN (2024). Portal Kombat: A structured and coordinated pro-Russian propaganda network. Technical report.
EDMO (2024). Russian disinformation network “Pravda” grew bigger in the EU, even after its uncovering.
DFRLab / Check First. The Pravda Network dashboard and investigations on cross-platform, multilingual influence operations.
EUvsDisinfo (2025). Large language models: the new battlefield of Russian information warfare.
Dataset propio generado mediante scraping con Selenium/Geckodriver sobre nodos news-pravda.com, mayo de 2026.
