CNCLEANNEWSNOTICIAS
MediosCongresoBOESenadoTemaAprendeJuegoJudicial
MetodologíaBorrador · v0.1

Metodología — Mapa de afinidad de cobertura mediática

Versión 0.1 (borrador) · Julio 2026 · CleanNews

Este documento se publica antes que el producto que describe. Los umbrales, criterios de validación e interpretaciones aquí fijados quedan registrados con anterioridad al primer cálculo sobre datos reales, y cualquier cambio posterior se documentará en el historial de versiones al final de este documento.


1. Qué medimos y qué no

CleanNews no clasifica ideológicamente a ningún medio. Este sistema mide un hecho observable: qué acontecimientos cubre cada medio y cómo los titula, y calcula la afinidad de comportamiento entre medios a partir de ese registro.

Distinguimos tres constructos que habitualmente se confunden bajo la palabra "sesgo":

  1. Ideología de la audiencia — dónde se autoubican los lectores de cada medio en el eje izquierda–derecha. No la medimos nosotros: la tomamos, con cita y año, de encuestas de terceros (Reuters Institute Digital News Report, edición España).
  2. Clasificaciones editoriales de terceros — valoraciones publicadas por evaluadores externos (p. ej. Media Bias/Fact Check). Se muestran atribuidas, enlazadas y fechadas. Nunca se funden con otras señales en una puntuación única de CleanNews.
  3. Comportamiento de cobertura — el objeto de este documento. Es la única capa que CleanNews calcula, y se limita a describir regularidades en datos públicos: qué historias selecciona cada medio y con qué encuadre las titula.

Cuando estas capas discrepan, la discrepancia se muestra. Es información, no ruido.

2. Datos de partida

  • Artículos: titular y URL canónica de los feeds RSS públicos de los medios dados de alta en la plataforma (lista pública y fechada). No se scrapea el cuerpo de los artículos.
  • Acontecimientos: los artículos se agrupan en acontecimientos mediante representaciones vectoriales de sus titulares (embeddings) y proximidad temporal. La metodología de agrupación tiene su propia documentación.
  • Todo dato institucional o de cobertura conserva su URL de origen.

3. Universo de acontecimientos elegibles

No todos los acontecimientos discriminan comportamiento editorial. Para entrar en el cálculo, un acontecimiento debe cumplir:

  • Cobertura mínima: al menos 3 medios distintos lo cubren (el acontecimiento existió más allá de una exclusiva aislada).
  • Cobertura máxima: lo cubre menos del 85 % de los medios activos (si lo cubren todos, no diferencia a nadie).
  • Sección: para la lectura interpretable del mapa se usan únicamente los acontecimientos clasificados en Política (análisis de sensibilidad con Política + Economía). El mapa sobre todas las secciones se calcula pero se presenta solo como "afinidad temática", nunca con lectura ideológica.

4. Métricas de afinidad entre pares de medios

Se calculan dos matrices separadas, porque miden cosas distintas:

Selección (¿eligen las mismas historias?). Sobre la matriz binaria medios × acontecimientos (1 = el medio publicó ≥1 artículo en el acontecimiento), la afinidad de cada par se mide con el coeficiente phi (correlación sobre variables binarias). Se descarta explícitamente el índice de Jaccard u otras medidas de intersección cruda: los medios difieren en un orden de magnitud en volumen de publicación, y una métrica sin control de tasa base mediría tamaño de feed, no criterio editorial.

Encuadre (¿cómo titulan lo que ambos cubren?). Para cada par de medios y cada acontecimiento que ambos cubren, la similitud coseno media entre los embeddings de sus titulares; la afinidad de encuadre del par es la media sobre sus acontecimientos compartidos.

Umbral de significación: un par de medios solo recibe valores si comparte n ≥ 30 acontecimientos elegibles en la ventana. Por debajo, la celda se publica como "sin datos suficientes", nunca estimada. Este umbral es el mismo criterio de n mínimo que CleanNews aplica en sus demás productos estadísticos.

5. Ventana temporal y recomputación

  • Ventana rodante de 90 días, recomputada semanalmente.
  • Cada publicación del mapa indica el rango exacto de fechas y el número de acontecimientos elegibles incluidos.
  • La ventana amplia amortigua el efecto de semanas dominadas por un único tema.

6. Reducción: el mapa

Sobre la matriz medios × acontecimientos elegibles se aplica análisis de correspondencias, reteniendo las dos primeras dimensiones, que se publican junto con su inercia explicada.

Las dimensiones no llevan etiqueta ideológica a priori. La dimensión 1 es una regularidad latente del comportamiento de cobertura. Que admita o no una lectura ideológica es una cuestión empírica que se resuelve en la validación (§7), no una decisión de diseño.

7. Validación (criterios fijados antes del primer cálculo)

Validación externa. Correlación de Spearman entre la posición de cada medio en la dimensión 1 y la autoubicación ideológica media de su audiencia según el Reuters Institute Digital News Report (España), sobre el subconjunto de medios presentes en ambas fuentes.

Validación interna. Estabilidad de las posiciones entre ventanas consecutivas y bajo remuestreo (bootstrap sobre acontecimientos; split-half temporal dentro de la ventana).

Criterio de publicación, pre-registrado:

  • Si |ρ| ≥ 0,7 con la señal de audiencia y las posiciones son estables bajo remuestreo, el mapa se publica con la nota: "la dimensión principal de comportamiento de cobertura correlaciona (ρ = X, n = Y) con la ideología de audiencia medida por el Reuters DNR". La lectura ideológica se presenta como correlato empírico, atribuido y cuantificado.
  • Si no se alcanza el criterio, el mapa se publica únicamente como afinidad de cobertura, sin lectura ideológica de ningún tipo.
  • En ningún escenario CleanNews asigna etiquetas categóricas ("izquierda", "derecha") a medios individuales.

8. Confusores conocidos y cómo se tratan

  • Sindicación y grupos editoriales. Cabeceras de un mismo grupo comparten agencia y contenidos; su afinidad refleja en parte estructura empresarial, no línea editorial. El mapa se calcula y publica en dos versiones: por cabecera y con las cabeceras colapsadas por grupo editorial.
  • Especialización temática. Medios especializados (tecnología, jurídico) se agrupan por temática. Por eso la versión interpretable se restringe a la sección Política (§3).
  • Medios internacionales en español. Los servicios exteriores (DW, BBC Mundo, France 24, RFI, Euronews) cubren una agenda distinta de la nacional y se excluyen del mapa de medios españoles; se listan aparte.
  • Volumen de publicación. Controlado por diseño mediante el coeficiente phi y el filtro de elegibilidad (§3, §4).

9. Limitaciones

  • La señal se basa en titulares, no en el cuerpo de los artículos. Mide selección y encuadre de portada, no la totalidad del tratamiento informativo.
  • El universo de medios es el dado de alta en CleanNews (lista pública); no es un censo del sistema mediático español.
  • La validación externa depende de la cobertura del Reuters DNR, que incluye solo los medios de mayor audiencia.
  • La afinidad de comportamiento no implica coordinación ni intencionalidad: describe regularidades, no las explica.
  • Un mapa de dos dimensiones es una simplificación; se publica la inercia explicada para que el lector juzgue cuánta estructura captura.

10. Qué no hace este sistema

  • No emite veredictos de verdad o falsedad sobre contenidos.
  • No clasifica ideológicamente a medios ni a periodistas.
  • No puntúa "calidad" ni "fiabilidad".
  • No mezcla las tres capas del §1 en un indicador único.
  • No usa modelos de IA generativa en el cálculo: es álgebra sobre datos de cobertura ya registrados. (La IA interviene únicamente aguas arriba, en la agrupación de artículos en acontecimientos, documentada aparte.)

11. Reproducibilidad y versionado

  • Cada publicación del mapa lleva: versión del método, rango de fechas, lista de medios activos, número de acontecimientos elegibles y parámetros vigentes.
  • Los cambios de método incrementan la versión y se anotan en el historial de este documento. Los resultados de versiones anteriores no se reescriben.
  • Los umbrales de este documento (3 / 85 % / n ≥ 30 / 90 días / ρ ≥ 0,7) quedan fijados en esta versión 0.1, antes del primer cálculo sobre datos reales.

12. Marco de referencia

El diseño se apoya en literatura estándar sobre paralelismo político en los sistemas mediáticos mediterráneos (Hallin y Mancini, Comparing Media Systems, 2004), medición computacional de slant a partir de elección de contenidos (Gentzkow y Shapiro, What Drives Media Slant?, Econometrica, 2010), escalado de comportamiento observado mediante reducción dimensional (familia NOMINATE, Poole y Rosenthal) y en los datos de audiencia del Reuters Institute Digital News Report (edición España). Las referencias exactas se verificarán y enlazarán antes de la publicación de la versión 1.0.


Historial de versiones

VersiónFechaCambios
0.1Julio 2026Borrador inicial. Umbrales y criterio de validación pre-registrados.

Cita sugerida: CleanNews (2026). Metodología del mapa de afinidad de cobertura mediática, v0.1. cleannews.org/metodologia/afinidad.

CleanNews sintetiza acontecimientos agregando varias fuentes; enlaza siempre al original y nunca reproduce el cuerpo de los artículos. Los datos institucionales proceden de sus registros oficiales.

Manifiesto·Mapa de medios·Metodología·Términos y condiciones·Privacidad·Cookies

Fuentes: Congreso · Senado · BOE · Tribunal Constitucional · ~60 medios españoles