Método
Versión 0.12.0. Todo ◆ mide desviación respecto al conjunto de cabeceras medidas; no existe línea base de realidad; la muestra son diarios digitales elegidos con un criterio público, una cabecera un voto, y no representa el consumo informativo español.
medidocontado sin modelo (piezas, horas, posiciones, cambios de titular, huecos).estimadosale de un modelo (agrupación en historias, descriptor, encuadre, tendencia, afinidad); siempre con n, periodo e intervalo.
ejemplosolo en esta página: parejas espejo con «Diario Ejemplo» y hechos inventados para ilustrar la rúbrica; nunca titulares atribuidos a cabeceras reales.
¿Medís el sesgo?
No publicamos una nota de sesgo ni nos describimos como neutrales: nos describimos como simétricos y descriptivos. Publicamos una estimación, con intervalo, de hacia dónde se sitúan los titulares de una cabecera respecto a los de las demás en las mismas noticias, y explicamos aquí cómo se calcula y cuánto se equivoca. No es lo mismo: no hay línea base de realidad, no hay una lista ordenada de cabeceras y una cabecera puede estar «a la izquierda del conjunto» un trimestre y no distinguirse del conjunto el siguiente. El eje se llama «izquierda-derecha del debate político español» y nombra el encuadre de un texto, no al medio: el medio solo recibe «desviación respecto al conjunto», siempre con n, periodo e intervalo, y gris cuando no se distingue del 0.
Esta página es el protocolo del observatorio: qué medimos, cómo, con qué cabeceras, con qué referencia y con qué tasas de error. Está versionada; cada cambio se anota en el registro del final y, si afecta a una cifra comparativa, abre una ruptura de serie marcada en los datos. La versión 0.9.0 se escribe antes de recoger el primer dato (la recogida empieza el 28 de septiembre de 2026); las tasas de error se rellenan con los datos y se depositan en OSF antes de la beta como «protocolo registrado con datos ya en recogida». La versión 0.10.0 añade el encuadre de los titulares y la tendencia estimada (sección 11), decididos el 4 de septiembre de 2026. La versión 0.11.0 (5 de septiembre de 2026) sustituye el conjunto de validación humano del encuadre por una validación automática, sin anotación humana (11.7) y extiende la recogida a todas las cabeceras configuradas (sección 2). La versión 0.11.1 (5 de septiembre de 2026, tarde) da de alta dos cabeceras más, ESdiario y Economía Digital (sección 2). La versión 0.12.0 (8 de septiembre de 2026) cambia la política de titulares literales: se publican por defecto en la página de cada noticia, con atribución y enlace, y lo que una cabecera declara en su aviso legal se cuenta como información, no como interruptor (sección 6).
Tres frases que valen para todo el sitio:
Somos simétricos y descriptivos, no «neutrales»: medimos desviaciones de cada cabecera respecto al conjunto de cabeceras medidas, no respecto a una línea base de realidad.
La muestra son diarios digitales elegidos con el criterio de la sección 2, una cabecera, un voto; no representa el consumo informativo español (fuera televisión, radio y redes).
Todo lo que sale de un modelo lleva la marca ◆ y su tasa de error publicada; lo que se cuenta sin modelo lleva la marca ■.
1. Qué medimos y cómo lo marcamos
- La unidad de análisis es la cabecera. Jamás una persona: no hay perfiles, puntuaciones ni recuentos por periodista, y nuestros tests lo comprueban.
- ■ Medido (hechos que se cuentan sin modelo): piezas en portada por cabecera y día; sección declarada por la propia cabecera; horas; cambios de titular; bandas de posición; huecos de datos.
- ◆ Según modelo («estimado»): la agrupación de artículos en noticias («historias»), el descriptor propio de cada historia (aunque sea texto nuestro, lo redacta un modelo), el tema (IPTC), la tipología de fuentes citadas, la afinidad entre cabeceras, el encuadre de los titulares y la tendencia estimada por cabecera (sección 11) y todas las métricas relativas.
- Ventanas: la portada del sitio es una ventana móvil de 24 horas; el archivo va por días naturales (00:00 a 24:00, hora de Madrid); toda métrica comparativa ◆ usa una ventana móvil de 90 días.
- Toda cifra lleva n, periodo y, si es de modelo, intervalo, referencia y sensibilidades. La celda «sin datos» nunca se confunde con «no detectada»: si no pudimos mirar, lo decimos.
1.1 Las tres marcas
Cada bloque del panel empieza con su marca y su palabra; dentro del bloque basta el símbolo. La leyenda fija del pie de todas las páginas dice: «■ medido: contado sin modelo (piezas, horas, posiciones, cambios de titular, huecos). ◆ estimado: sale de un modelo (agrupación en historias, descriptor, encuadre, tendencia, afinidad); siempre con n, periodo e intervalo.»
| Marca | Qué señala | Dónde aparece |
|---|---|---|
| ■ MEDIDO | Un recuento sin modelo: piezas en portada, horas, posiciones y bandas, cambios de titular, huecos de datos, n de cualquier cifra | En todo el sitio |
| ◆ ESTIMADO | Una salida de un modelo, con su tasa de error publicada aquí; la palabra que sigue dice de qué modelo: «◆ ESTIMADO · AGRUPACIÓN», «· DESCRIPTOR», «· ENCUADRE», «· TENDENCIA», «· AFINIDAD» | En todo el sitio; toda cifra ◆ lleva n, periodo e intervalo, y si el intervalo toca el cero se pinta en gris y se lee «Sin diferencia detectable» |
| ⌗ EJEMPLO | Un dato inventado para explicar cómo se lee una pieza: siempre «Diario Ejemplo A-H» o una pareja espejo, nunca un titular inventado atribuido a una cabecera real | Solo en esta página y en las maquetas; en el panel público no se muestra jamás |
Un recuento dentro de un bloque ◆ (por ejemplo, «7 de 15 cabeceras con datos») sigue siendo ■: se cuenta, no se estima; lo que es ◆ es el bloque que lo rodea (la agrupación que decide qué es «la misma noticia»).
2. Cabeceras y criterio
Criterio público: diarios digitales generalistas de ámbito nacional con audiencia en GfK DAM o relevancia política declarada por el Reuters Institute, más los dos económicos técnicamente accesibles, más las agencias y RTVE como referencia (medidas con las mismas reglas, fuera del denominador de las comparaciones). Deportivas y regionales quedan fuera. Son 31 cabeceras configuradas: 26 medidas, 4 de referencia y una excluida por motivos técnicos.
| Cabecera | Grupo (fuente y fecha en su página) | Tipo | Oleada de entrada | Situación legal declarada | Nota técnica |
|---|---|---|---|---|---|
| eldiario.es | Diario de Prensa Digital | generalista | A1 (desde el 28-9-2026) | licencia CC BY-NC 4.0 | rotación alta |
| Público | Display Connectors | generalista | A1 | oposición a la cita en recopilaciones (art. 32.1) | sin RSS; sitemap; Crawl-delay 5 s |
| infoLibre | Ediciones Prensa Libre | generalista | A1 | — | sin «% de muro» publicable |
| El Plural | Corporate Communicator | generalista | A1 | oposición 32.1 | |
| El Salto | propia | generalista | A1 | CC BY-SA (por verificar) | Crawl-delay 1 s |
| El Español | El León de El Español | generalista | A1 | oposición 32.1 («fines comerciales») | |
| OKdiario | Dos Mil Palabras | generalista | A1 | CC-NC + oposición 32.1 | rotación alta |
| El Debate | ACdP | generalista | A1 | — | |
| Libertad Digital | LD S.A. | generalista | A1 | — | RSS en servidor externo |
| EFE | Agencia EFE (SEPI) | agencia | referencia, A1 | — | |
| Europa Press | IITC (52 % desde 19-6-2025) | agencia | referencia, A1 | oposición 32.1 | rotación alta |
| RTVE | Corporación RTVE | público | referencia, A1 | — | cuerpo por párrafos |
| El País | PRISA | generalista | A2 (tras la nota jurídica previa) | reserva 67.3 + «frente a IA»; 32.1 pendiente de verificar | probablemente sin posición |
| El Mundo | Unidad Editorial | generalista | A2 | reserva 67.3 | navegador; sin sitemap de noticias; sin cuerpo hasta localizar marcador |
| ABC | Vocento | generalista | A2 | reserva 67.3 | cuerpo del feed; sin marcador fiable |
| La Razón | Planeta | generalista | A2 | — | rotación alta |
| 20minutos | Henneo | generalista | A2 | reserva 67.3 (cualquier finalidad) + oposición 32.1 y 33.1 | |
| El Confidencial | Titania | generalista | A2 | oposición 32.1 | WAF intermitente |
| El Periódico | Prensa Ibérica | generalista | A2 (adelantado) | prohíbe «recolección automática» | edición castellana canónica |
| HuffPost | PRISA Media | generalista | A2 | reserva 67.3 + IA; oposición 32.1; 33.1 | |
| La Marea | propia | generalista | B1 | por caracterizar (W1) | |
| Vozpópuli | Vozpópuli Digital | generalista | B1 | oposición 32.1 | RSS no disponible; sitemap |
| Cinco Días | PRISA | económico | B2 | reserva 67.3; 32.1 pendiente | sin posición previsible |
| The Objective | The Objective Media | generalista | B2 | — | Crawl-delay 5 s |
| La Vanguardia | Godó | generalista | B3 | reserva 67.3 + IA | navegador; edición castellana canónica |
| El Independiente | Park Row | generalista | B3 | — | |
| Expansión | Unidad Editorial | económico | B4 | reserva 67.3 | sin cuerpo hasta localizar marcador; primera entrega recortable |
| ESdiario | El Semanal Digital | generalista | B5 (alta el 5-9-2026) | — | sin sitemap de noticias accesible (403); dos RSS |
| Economía Digital | Economía Digital S.L. | económico | B5 (alta el 5-9-2026) | — | cuerpo íntegro en el feed; portada con caché de ~30 min |
| elEconomista | Ecoprensa | económico | excluida técnica | — | 403 a todo, incluido robots.txt; lista blanca pedida |
| El Nacional (ed. castellana) | propia | generalista | referencia (polo territorial), desde la fase 4 | oposición 32.1 | feed en castellano |
La Información (lainformacion.com) no figura como cabecera: desde el 22 de mayo de 2024 es el vertical económico de 20minutos («La Información económica», bajo 20minutos.es/lainformacion/) y sus piezas se recogen dentro de 20minutos; su dominio antiguo ya no publica un robots.txt legible.
La columna «Situación legal declarada» dice lo que el editor declara en su aviso legal, no lo que hacemos con sus datos: «oposición 32.1» significa que su aviso incluye una oposición a la cita en recopilaciones periódicas (press clipping), no que su titular no se vea. Lo registramos, lo publicamos en su página y lo explicamos en la sección 6; lo que apaga un titular es que el editor nos lo pida. «Reserva 67.3» es una reserva de minería de textos, y afecta a lo que se puede procesar de forma automatizada, no al uso en línea.
Estados de una cabecera, visibles en Estado: activa · sin posición (leemos feeds y sitemaps, no capturamos portada sin sortear un bloqueo) · sin cuerpo · excluida técnica · excluida por el editor.
Familias (solo para agrupar en el mapa de medios y en los chips de estado; no entran en ningún cálculo): grandes grupos, nativos digitales, económicos y referencia. Se derivan del tipo y del grupo de cada cabecera y se publican en su ficha.
Ediciones bilingües (La Vanguardia, El Periódico): la edición en castellano es la canónica; las direcciones de la edición catalana se reconocen y se excluyen de cobertura, volumen y descubrimiento. El Nacional se mide por su feed en castellano.
Oleadas: A1 y A2 forman la beta (17 cabeceras medidas + 3 de referencia); la oleada B entra en cuatro entregas durante 2027 (ESdiario y Economía Digital, dadas de alta el 5-9-2026, se anotan en la última, B4), cada una solo cuando su descubrimiento por feed o sitemap lleva siete días al 95 %. Una cabecera nueva entra en las métricas comparativas al completar 90 días de datos y nunca durante una congelación electoral; su fecha de entrada se marca en la serie.
Recogida desde el 5 de septiembre de 2026. Por decisión del responsable del proyecto, la recogida abarca desde ese día las 30 cabeceras accesibles (todas las configuradas salvo elEconomista, que bloquea a nuestro bot; 28 hasta el alta de ESdiario y Economía Digital esa misma tarde), incluidas las nueve cuyos avisos legales reservan la minería de textos (art. 67.3 LPI): El País, El Mundo, ABC, 20minutos, El Periódico, HuffPost, Cinco Días, La Vanguardia y Expansión. La columna «oleada de entrada» de la tabla refleja el calendario del plan original y se conserva como referencia; ya no es una fecha de entrada en la recogida. Lo que no cambia: cada cabecera entra en las métricas comparativas al completar 90 días de datos y nunca durante una congelación electoral; cómo respetamos las reservas de minería —no conservando textos— y qué guardamos de cada cabecera está en Nuestro bot y en la sección 4.
3. El prior externo: un dato ajeno citado, nunca una etiqueta nuestra
Para componer la muestra y para un análisis de sensibilidad —y para nada más— usamos una posición ideológica externa por cabecera, tomada por este orden de: CIS 2023 (escala 1-10; número de estudio pendiente de verificar con los microdatos), Media Bias/Fact Check (categoría publicada), Guerrero-Solé 2022 (dos clústeres) y Wikipedia/Wikidata. Nunca reinterpretamos un número: aplicamos reglas de corte mecánicas, publicadas aquí y aplicadas sin excepción.
| Instrumento | Regla de corte → nivel |
|---|---|
| CIS (1-10) | < 4 → izquierda · 4-4,75 → centro-izquierda · 4,75-5,25 → centro · 5,25-6 → centro-derecha · > 6 → derecha (cortes simétricos alrededor del punto medio) |
| MBFC | Left → izquierda · Left-Center → centro-izquierda · Least Biased → centro · Right-Center → centro-derecha · Right → derecha (su categoría publicada, sin releer el número) |
| Guerrero-Solé | clúster → lado, sin nivel intermedio |
| Wikipedia/Wikidata | tabla de equivalencia literal, publicada con la tabla de cabeceras |
Efecto visible de la regla, para que nadie lea el nivel como adjetivo nuestro: con el CIS, El Mundo (6,9) cae en «derecha» y con MBFC en «centro-derecha»; prevalece el primer instrumento disponible y la tabla muestra siempre el valor numérico y la fuente junto al nivel derivado.
| Cabecera | Instrumento | Valor | Nivel derivado |
|---|---|---|---|
| Público | CIS 2023 | 3,27 | izquierda |
| El País | CIS 2023 | 4,15 | centro-izquierda |
| eldiario.es | CIS 2023 | 4,47 | centro-izquierda |
| El Mundo | CIS 2023 | 6,9 | derecha |
| OKdiario | CIS 2023 | 7,08 | derecha |
| ABC | MBFC | 3,9 (categoría publicada por verificar) | pendiente |
| Resto | según orden de instrumentos | se publica con la versión 1.0 de esta tabla, desde config/cabeceras.yaml |
Lados para la regla de composición: I = izquierda + centro-izquierda; D = centro-derecha + derecha; el centro no cuenta en ningún lado. Tres cabeceras son ambiguas según el instrumento (20minutos, La Vanguardia, El Confidencial): mantenemos dos escenarios (A: Wikipedia/Wikidata; B: sinsesgo/Guerrero-Solé) y publicamos la sensibilidad de todo resultado estratificado al intercambio de esas tres.
Regla 50/30: ningún lado puede ser más del 50 % ni menos del 30 % de las cabeceras activas para esa familia de métricas; se evalúa por familia (cobertura y selección, alimentadas por feeds y sitemaps, donde las «sin posición» cuentan; prominencia y titulares de portada, donde no; encuadre, con las cabeceras que permiten anotación y tienen portada). Exactamente el 50 % está permitido y se marca «al límite». Si se rompe —por exclusión, bloqueo o entrega de una oleada— se publica una nota automática y el análisis de sensibilidad estratificado aparece junto a la cifra principal, que no cambia. Publicamos además la composición efectiva (cuota de observaciones válidas por lado), porque los datos que faltan no faltan al azar.
El prior no entra en ninguna métrica principal ni en los datos abiertos. Tampoco en el encuadre de los titulares: el modelo que los lee no sabe de qué cabecera es cada titular (sección 11.4).
4. Recogida
- Canales: feeds RSS/Atom (cada 10 min) y sitemaps de noticias (cada 15) para descubrir artículos; la portada (cada 15 min en las cabeceras de rotación alta, cada 30 en el resto, cada 60 de 01:00 a 06:00) para la posición; la página de cada artículo para sus metadatos y, si es de acceso abierto, su cuerpo en memoria. Cómo se comporta el bot: Nuestro bot.
- Identidad del artículo: dirección normalizada (sin parámetros de seguimiento, sin fragmento, sin variantes AMP) y dirección canónica declarada por la cabecera si su dominio coincide.
- Dos horas:
hora_declarada(la que publica la cabecera en sus metadatos o en el sitemap; si falta la zona horaria se asume Madrid y se marca) yhora_observada(la primera vez que la vimos). Se marcan como sospechosas las fechas declaradas más de 15 minutos en el futuro o más de 7 días en el pasado; una dirección que reaparece con fecha nueva se marca como reciclada. - Día = 00:00 a 24:00, hora de Madrid.
- Lo que no guardamos (en ningún soporte): cuerpos, entradillas, HTML, capturas, imágenes. Lo que se lee del cuerpo abierto se procesa en memoria y se descarta en la misma pasada; lo único que queda es una huella y unos conteos.
5. Portada y posición
- Qué portada: la que la cabecera sirve a un navegador de escritorio sin JavaScript (en El Mundo y La Vanguardia, la que renderiza un navegador automatizado a 1280×900); edición en castellano en las bilingües.
- Posición = orden de aparición de los enlaces de artículo dentro del cuerpo principal, excluidos menú, pie, «lo más leído» y módulos de opinión y servicios según reglas escritas por cabecera; más el bloque (apertura, columna, faldón).
- Prominencia, constructo primario: bandas absolutas — apertura, 2-10, 11-30, resto. Una posición solo cuenta si se sostiene en dos capturas consecutivas: así una pieza que pasa un instante por arriba en una portada de rotación alta no cuenta como prominente. Medida continua secundaria: posición media ponderada por los minutos en portada (sobre hora efectiva, corregida por la antigüedad de caché que declara el servidor). El percentil dentro de la cabecera queda solo como robustez en la serie descargable.
- Estabilidad: dos capturas separadas 60 segundos, a las 12:00 y a las 19:00; τ de Kendall y RBO sobre los enlaces presentes en ambas. Si baja de 0,90, la cabecera pasa a bandas puras (sin la medida ponderada) y lo decimos.
- Validación visual trimestral, sin capturas almacenadas: 10 portadas por cabecera a horas distintas, anotadas a mano a 1280 y 390 píxeles (dos personas en la primera ronda); publicamos por cabecera la correlación entre el orden del DOM y el orden visual y la exactitud de las bandas frente a «visible sin desplazarse». Limitación declarada: escritorio, sin JavaScript, huecos publicitarios.
- Las cabeceras sin posición (El País y Cinco Días, previsiblemente) quedan fuera de la familia de prominencia y dentro de cobertura; la métrica de prominencia lleva «sin El País» en el nombre si procede.
6. Titulares
- Guardamos cada versión del titular por cabecera (portada, feed, sitemap, h1, Open Graph) con la primera y la última vez que la vimos. Un cambio solo se registra si persiste dos capturas seguidas; si dos textos alternan en la misma franja se marca como probable prueba A/B y se publica la tasa de oscilación por cabecera.
- «Primera detectada» (no «primera en publicar»): la cabecera cuyo artículo sobre una historia vimos antes, con la resolución que permiten los canales (feeds 10 min, sitemaps 15) y empates por debajo de 15 minutos. El Mundo y Expansión quedan fuera de esta medida mientras no publiquen sitemap de noticias. EFE y Europa Press sirven de referencia temporal. La hora declarada se calibra contra la observada por cabecera, solo entre cabeceras con sitemap de noticias, y publicamos el desplazamiento mediano.
- Titulares literales: aparecen únicamente en la página de cada noticia y en su embed, como cita con fines de análisis: con fuente, nombre del autor si consta, hora y enlace al original, ocho como máximo por noticia. En todo lo demás (portada, tarjetas, página de cabecera, descargas, redes) se usa el descriptor propio + cabecera + enlace. Si una cabecera tiene los titulares literales apagados, la tarjeta dice «Titular no reproducido» y enlaza al original; nunca reconstruimos un titular a partir de su dirección.
- Por qué reproducimos el titular y no el texto (política del 8 de septiembre de 2026): el art. 129 bis LPI, que reconoce a los editores de prensa un derecho sobre el uso en línea de sus publicaciones por prestadores de servicios de la sociedad de la información, exceptúa expresamente los hipervínculos y el uso de «palabras aisladas o extractos muy breves». Un titular con atribución y enlace al original, en un sitio sin ingresos de ningún tipo y publicado como objeto de análisis —con sus métricas al lado y ocho como máximo por noticia—, es eso: un extracto muy breve más un enlace. El párrafo segundo del art. 32.1 LPI, el de las recopilaciones periódicas, exige a la vez «fines comerciales» y «mera reproducción», y aquí no se da ninguna de las dos. El cuerpo del artículo, la entradilla y el HTML no se guardan nunca y no se publican nunca, ni de una cabecera ni de ninguna (sección 12). Límite que declaramos: «extracto muy breve» no está delimitado por los tribunales españoles y tenemos un dictamen jurídico pedido sobre esta cuestión; si concluye lo contrario, apagamos los titulares en un despliegue y lo decimos aquí.
- Lo que declara un aviso legal se publica, y no decide: varias cabeceras incluyen en su aviso legal una oposición a la cita en recopilaciones periódicas (art. 32.1, press clipping). Lo registramos con su fecha, lo mostramos en la página de esa cabecera y lo listamos en la tabla de la sección 2, para que quien lea sepa qué ha dicho el editor. Un aviso legal es una declaración unilateral: no lo firma nadie por leer una portada, y no puede ampliar por sí solo el alcance de un derecho legal ni recortar una excepción legal. Por eso lo contamos y no lo usamos como interruptor. Lo que sí lo apaga es que el editor nos lo pida.
- Criterio determinista de los ocho: ronda 1, la primera detectada; ronda 2, por grupos de afinidad estables (si no los hay, un solo grupo), en rondas, la cabecera sin plaza cuyo titular está más alejado del centroide de la historia; los duplicados exactos de teletipo se muestran una vez con «también en: X, Y» y no consumen plaza; las cabeceras sin posición participan igual.
- Interruptores: los titulares literales están encendidos por defecto y solo se apagan por cuatro vías, ninguna discrecional. (1) El editor lo pide desde Editores: la exclusión con alcance «sin titulares literales» o total se aplica en ≤ 15 minutos, sin exigirle base jurídica ni discusión, y queda anotada en público. (2) Su
robots.txtnos nombra: unDisallowpara nuestro bot se convierte en una exclusión total. (3) Caducidad: a los 24 meses. (4) El interruptor global, que apaga el sitio entero en un despliegue. El interruptor por cabecera se deriva de la evidencia legal registrada, nunca se pone a mano (es una regla con test), y la evidencia que lo apaga es la petición del editor, no una cláusula de su aviso legal. - Caducidad: 24 meses desde la publicación, un titular público se sustituye por descriptor + enlace. Es una decisión propia más estricta que el plazo del art. 130.3 LPI (dos años desde el 1 de enero siguiente a la publicación).
7. Agrupación en noticias (◆)
- Cada artículo se representa con un vector (modelo
multilingual-e5-small, 384 dimensiones) calculado sobre titular y entradilla (≤ 128 tokens) y se asigna en línea a una historia abierta si la similitud combinada (coseno 0,7 + coincidencia de entidades 0,3) supera un umbral θ fijado con el conjunto de referencia (valor inicial 0,80), dentro de una ventana de 72 horas. Cuando ni el artículo ni la historia tienen entidades reconocidas, decide solo la similitud de vectores (decisión provisional, pendiente de calibrar con el conjunto de referencia). Cada hora se refunden historias por aglomeración. El vector se borra a las 72 horas. - Segunda pasada laxa: para las historias candidatas a «Lo que llevaron pocas», se busca en cada cabecera «no detectada» una pieza con entidades compartidas, dentro de la ventana, con umbral θ − 0,1; si aparece, el estado pasa a «posible pieza con otro encuadre» en lugar de «no detectada».
- Granularidad: reglas escritas antes de anotar («X comparece» y «reacciones a la comparecencia»: ¿una historia o dos?), con pares espejo como ejemplos.
- Cierre: a las 48 horas de la primera observación la historia se cierra para anotación; deja de admitir artículos 72 horas después de su última incorporación.
- Teletipos: sobre los cuerpos abiertos, una huella MinHash (5-shingles) detecta artículos casi idénticos a un teletipo de EFE o Europa Press (Jaccard ≥ 0,7); una similitud alta de vector con MinHash bajo se reporta aparte como «reescritura».
- Descriptor propio (◆): un modelo local (Gemma 4 E2B, en nuestro servidor) redacta para cada historia una descripción de ≤ 12 palabras que no puede compartir ningún 5-grama con ningún titular de la historia (test) y debe respetar un lexicón publicado de términos disputados con la forma elegida para cada uno (la del BOE o la denominación institucional cuando existe; la más frecuente en los titulares de la historia cuando no). Cien descriptores al trimestre son juzgados por al menos dos personas de posición distinta; se publica la tasa de rechazo por el lexicón. Si no hay modelo disponible, el descriptor se escribe a mano. Desde la versión 0.10.0 el descriptor tiene además un control de carga (sección 11.3): se juzga con la misma rúbrica que los titulares y, si no sale descriptivo, la historia no entra en la vista de encuadre y el caso alimenta la validación del descriptor.
- Actor de una historia: la moda del sujeto de los titulares del clúster (o el identificador Wikidata más frecuente), no el sujeto de cada artículo; las historias con actor ambiguo se excluyen de las métricas por actor y se publica su porcentaje.
8. Los cuatro estados de cobertura
Para cada historia y cabecera:
| Estado | Significado | Condición |
|---|---|---|
| En portada | Vimos la pieza en la portada (banda y minutos) | — |
| Publicada, no en portada | Vimos la pieza por feed o sitemap pero no en la portada | — |
| No detectada en portada | Miramos y no encontramos pieza | solo si el recall de descubrimiento y el de asignación de esa cabecera son ≥ 0,9 (medidos en el día-gold y publicados); si la pasada laxa encuentra candidata: «no detectada en portada · posible pieza con otro encuadre →» |
| Sin datos | No pudimos mirar (bloqueo, fuente sin frescura, exclusión) | causa en Estado |
No usamos formulaciones que imputen omisión a una cabecera: «no detectada» describe nuestro instrumento, no su redacción.
9. Referencia y sensibilidades de toda métrica ◆
- Referencia primaria: un modelo de efectos fijos de historia y cabecera,
y = α_historia + β_cabecera + error, sobre las observaciones (historia, cabecera) con datos válidos en la ventana de 90 días.αabsorbe que unas historias sean más prominentes para todas;βes la desviación de la cabecera respecto al conjunto, con suma cero sobre el panel de cabeceras presentes toda la ventana. Formaliza «desviación respecto a las demás en las mismas historias» y absorbe los datos faltantes. - Intervalo del 95 % por bootstrap por bloques de día (90 bloques, reajustando el modelo en cada réplica, BCa).
- Mínimos: solo historias con ≥ 8 cabeceras con datos válidos; solo cabeceras con ≥ 30 historias compartidas en la celda (por cabecera; por cabecera × actor en las métricas por actor).
- Calibración por azar: en cada familia de métricas barajamos la etiqueta de cabecera dentro de cada historia 1.000 veces y publicamos cuántas «diferencias detectables» se esperan por azar; las p por cabecera se ajustan por Benjamini-Hochberg dentro de la familia; una cabecera solo se muestra «por encima» o «por debajo» si supera el ajuste.
- Regla de lectura fija: si el intervalo cruza cero → «Sin diferencia detectable»; si el signo del modelo difiere del de una sensibilidad → «Depende de la referencia».
- Sensibilidades (en la misma celda, desplegables, nunca como cifra principal): S1 mediana simple de las demás cabeceras en las mismas historias; S2 mediana estratificada por lado del prior (media de la mediana de I y la de D; el centro aparte), etiquetada «depende del prior externo»; S3 ponderación por audiencia solo con las cabeceras con cifra pública de GfK DAM, sin imputar nada a las demás.
- En el informe anual: todo ◆ también con RTVE y las agencias dentro del denominador; intercambio de las tres cabeceras ambiguas; ventanas con y sin las cabeceras entradas a mitad de serie.
10. Métricas de la versión 1.0
■ Hechos por cabecera (desde el primer día, con n): piezas en portada por día; sección declarada; cobertura compartida frente a propia (la agrupación es ◆ y se marca); primera detectada; cambios y variantes de titular; directos; opinión frente a información (por sección o dirección declaradas); huecos de datos. Vista «esta semana frente a sus 90 días».
◆ Dependencia de agencia: porcentaje de artículos abiertos casi idénticos a un teletipo de EFE o Europa Press, con n_abiertos / n_total visible y la «reescritura» aparte; nunca como comparación entre cabeceras con distinto porcentaje de cuerpo abierto.
◆ Agenda por tema (IPTC) y ◆ tipología de fuentes citadas (Gobierno central; gobierno autonómico o local; partido, por nombre; judicial; policial y fuerzas de seguridad; patronal; sindicato; experto o académico; ONG o asociación; empresa; otro medio; agencia; documento oficial; anónima): se publican con la exactitud y el acuerdo del conjunto de referencia.
◆ Atención por actor y ◆ Prominencia por actor: historias por actor o tema y banda sostenida de las historias cuyo actor principal es cada bloque, cabecera frente al conjunto. En la versión 1.0 no hay tono, así que miden atención, no valoración, y se llaman así.
Lo que llevaron pocas (descriptivo): historias en banda apertura o 2-10 sostenida en al menos una cabecera y en portada en menos del 25 % de las cabeceras con datos ese día; se publica con el denominador (cuántas historias cumplieron el criterio) y el número esperado por azar bajo permutación, porque un top-5 entre ~150 historias siempre existe. El bloque evaluativo («Cobertura desigual»: prominente en un grupo de afinidad estable y no detectada, tras la pasada laxa, en el resto) no existe en la interfaz hasta que la tasa de falsos «no detectada» medida en el conjunto de referencia sea < 2 % y los grupos sean estables.
Consenso de hechos por conteo (cifra, sujeto, fuente citada) con «hechos que solo aparecen en una cabecera o en pocas». En la página de cada noticia se muestra como «En qué coinciden y en qué no»: «k de N coinciden» por rasgo (cifra ■; fuente citada, sujeto y verbo ◆) y los «términos que solo usa una cabecera», sin atribuirlos a ninguna firma.
Titulares más distintos según el modelo: el par de titulares de una historia con menor similitud de vector, excluidos duplicados de teletipo y titulares de menos de 6 palabras; validado en 30 historias del conjunto de referencia (dos personas deben coincidir con el par o su top-3 en ≥ 70 %); se publica el conteo mensual de apariciones por cabecera. En pantalla se muestran los dos titulares enfrentados, nunca una cifra de distancia.
◆ Afinidad de agenda (a partir de 90 días): asociación entre pares de cabeceras corregida por marginales (modelo nulo con sumas de fila y columna fijas, permutación curveball sobre la matriz historia × cabecera restringida a historias con ≥ 3 cabeceras, 1.000 réplicas): desviación estandarizada u odds ratio con intervalo, más P(B cubre | A cubre) en ambas direcciones. Dendrograma con estabilidad bootstrap de los grupos y corte pre-registrado (máxima estabilidad); si la estabilidad es < 0,7, no hay grupos y lo decimos, y todo lo que depende de los grupos cae a su modo sin grupos. Lista mensual de «con quién coincidió más» (tres asociaciones mayores y menores con intervalo y n). Distancias a EFE, Europa Press y RTVE por separado, publicadas como rango («4.º de 24 · n historias»), nunca como cifra; ninguna es una línea base. Es afinidad de agenda (qué se cubre), no de encuadre: por eso no lleva el color del eje.
◆ Encuadre de los titulares y tendencia estimada: la sección siguiente.
Dos regímenes en la página de cada cabecera: ■ con n desde el primer día; ◆ solo con n ≥ 30; la tendencia estimada, además, solo con ≥ 20 días y con la validación automática abierta (sección 11.6).
11. Encuadre de los titulares y tendencia estimada (◆)
Versión del método: encuadre-juez/0.2. Decidido el 4 de septiembre de 2026 y enmendado el 5: no hay conjunto de validación humano; la validación es automática (11.7) y toda cifra por cabecera lleva la marca «estimación con validación automática, sin anotación humana». Se calcula y se muestra desde el 4-9-2026 en el panel de desarrollo, marcado como provisional; en público la cifra por cabecera solo aparece cuando las puertas automáticas llevan siete corridas abiertas y hay datos suficientes (11.6), y a 5 de septiembre de 2026 no las abre. Esta sección es la única del sitio donde aparecen las categorías de la rúbrica y los ejemplos, siempre con la marca ⌗ EJEMPLO.
11.1 Qué es, en un párrafo
Un modelo de lenguaje local lee cada titular de portada de una noticia que llevan varias cabeceras, junto con nuestro descriptor propio de esa noticia, y lo clasifica en cinco tramos según cómo la cuenta en el eje izquierda-derecha del debate político español. La tendencia de una cabecera es la desviación media de sus titulares respecto al conjunto de cabeceras medidas en las mismas noticias, en 90 días, con intervalo. Es una estimación del encuadre de textos, no una etiqueta ni una nota del medio.
Lo que significa la puntuación: en qué medida las palabras elegidas, a quién se presenta como responsable o víctima y qué valor se invoca en el titular se acercan a la forma de contar el hecho propia de la izquierda o de la derecha del debate español. Lo que no significa: que el hecho sea de izquierda o de derecha (una subida de impuestos, una llegada de migrantes o una huelga no lo son: lo es la forma de contarlas), ni que la cabecera «sea» de un lado, ni nada sobre quien firma.
11.2 Escala y anclas
La escala publicada es continua en [−1, +1] y sale de una escala ordinal interna de cinco tramos (−2…+2, dividida por 2). Se muestra siempre con dos decimales y signo (−0,42, +0,17). El color del eje es rojo para la izquierda, azul para la derecha y gris para el centro, la convención española (la contraria a la anglosajona), por eso los polos se escriben en cada eje: «← Izquierda» y «Derecha →». El color solo pinta marcadores, puntos, pistas y el texto de los polos; nunca fondos ni nombres de cabecera.
| Valor | Categoría de la rúbrica | Ejemplo ⌗ (misma noticia inventada: unas 300 personas entran a nado en una ciudad fronteriza; ninguno atribuido a una cabecera real) |
|---|---|---|
| −1 | claramente de izquierda | «Cientos de personas migrantes llegan exhaustas a la ciudad tras huir de la miseria y piden protección» |
| −0,5 | tiende a la izquierda | «ONG denuncian que se devolvió a personas migrantes “como sacos” en la frontera» |
| 0 | descriptivo | «Unas 300 personas entran en la ciudad a nado en una noche, según la Delegación del Gobierno» |
| +0,5 | tiende a la derecha | «El líder de la oposición: “No fue una crisis migratoria, fue una invasión”» |
| +1 | claramente de derecha | «Avalancha de ilegales: la invasión desborda a la Policía mientras el Gobierno mira a otro lado» |
| N | no aplica | «La Aemet prevé lluvias en el norte este fin de semana» |
Las categorías jamás aparecen junto al nombre de una cabecera en el panel: allí solo hay valor, banda e intervalo sobre el eje, y en el eje solo hay dos polos escritos y un cero que dice qué es («0 = descriptor propio» en la vista por noticia; «0 = conjunto de cabeceras medidas» en la ficha de cabecera y en el mapa). No hay zonas con nombre.
11.3 Cómo se calcula
Qué entra. Historias con titular informativo en al menos 3 cabeceras que permiten anotación; para la cifra por cabecera solo cuentan las historias con al menos 8 cabeceras aplicables (6 en repliegue, medido y declarado; nunca menos de 5). Ámbito político en tres capas, cada una con su porcentaje de excluidas publicado: la sección declarada no es deportes, cultura, ciencia ni tecnología; el descriptor de la noticia, juzgado con la misma rúbrica, tiene lectura política (no es «no aplica»); y si la historia tiene actor principal, es un partido o una figura pública. Por cabecera y noticia, hasta 3 piezas informativas (ni opinión ni directos), primero la de portada con mejor banda sostenida; el titular vigente (el que ve el lector) y solo si tiene al menos 5 palabras. Los teletipos idénticos entre cabeceras se juzgan una vez y su puntuación se copia (se publica el porcentaje de celdas afectadas). Antes de juzgar, dos guardarraíles de pertenencia: el titular debe parecerse a los titulares de las demás cabeceras de la historia (coseno con el centroide por encima de un umbral recalibrado cada semana) y una pregunta de una letra al modelo («¿habla de la misma noticia?»); las piezas excluidas se cuentan y no entran en ninguna celda.
Qué ve el modelo. Solo el titular anonimizado (los nombres, dominios y variantes de las 31 cabeceras sustituidos por «este medio»; prefijos de plantilla fuera), el descriptor propio de la noticia y, si el titular lleva una cita atribuida, la pista «el titular atribuye la frase entrecomillada a un tercero». Nada más: ni cabecera, ni firma, ni dirección, ni hora, ni sección, ni entradilla. Un test exige cero fugas de nombre de cabecera al prompt.
Por titular. El modelo responde una sola letra (A-E o N) con la rúbrica de 11.5, en dos órdenes de escala (A = izquierda … E = derecha, y al revés), y leemos la distribución completa de probabilidades de la primera letra, no solo la elegida: la esperanza en cada orden (E_ID, E_DI) se promedia y se divide entre 2 → s ∈ [−1, +1]. La probabilidad de N se promedia → p_N; el titular aplica si p_N < 0,5. Si los dos órdenes discrepan de lado con fuerza (E_ID · E_DI < 0 y ambos |E| ≥ 1) el titular es inconsistente: no se descarta (descartarlos sesga la escala hacia los extremos), entra con su media (≈ 0, un empate) y su tasa se publica. Con temperatura 0 el modelo es determinista: repetir la misma pregunta no mide nada; repetir con la escala invertida sí. Se guardan además las palabras de nuestra rúbrica presentes en el titular («lo que el modelo tenía delante»), que son las que la ficha muestra como razón corta; nunca fragmentos del titular ajeno.
Por noticia y cabecera (celda). Media de s de las piezas que aplican; si ninguna aplica la celda no existe (no es un cero). Se muestra como banda (mínimo-máximo de sus piezas; ±0,25 si solo hay una), porque por noticia la lectura orienta, no separa. De cada pieza se guardan su huella, sus letras y su puntuación: nunca el texto.
Por noticia. El conjunto de la noticia (α_h, el desplazamiento medio de todas las cabeceras en esa noticia) se pinta como rombo hueco gris. El descriptor se juzga como un titular más: debe salir descriptivo (|s| ≤ 0,25); si sale «no aplica», la noticia queda fuera del ámbito; si sale con carga, la noticia no entra en la vista de encuadre y el caso alimenta la validación del descriptor. La noticia muestra encuadre solo si tiene ≥ 3 celdas, el descriptor pasó su control, está en ámbito y el recorrido entre sus celdas supera el doble del suelo de ruido de la corrida (la diferencia mediana entre dos redacciones descriptivas del mismo hecho en los controles de paráfrasis); si no, «Encuadre: sin lectura» y el motivo en texto fijo.
Por cabecera (90 días). El mismo modelo de efectos fijos de la sección 9, y = α_historia + β_cabecera + error, sobre las celdas de historias con ≥ 8 cabeceras aplicables, con suma cero sobre el panel balanceado: β es la desviación de la cabecera respecto al conjunto en las mismas noticias, y α absorbe el encuadre medio de cada noticia, de modo que qué temas cubre una cabecera (agenda) no se confunde con cómo los titula (encuadre). Intervalo del 95 % por bootstrap por bloques de día. El punto publicado es β encogido hacia cero (James-Stein: cuanto mayor es la incertidumbre de una cabecera, más se acerca su punto a 0; si las cabeceras no se distinguen entre sí, todos los puntos son 0 y así se dice); el intervalo publicado es el de β sin encoger, ampliado si hace falta hasta contener el punto encogido (nunca más estrecho que el bootstrap), y la lectura se decide sobre ese punto y ese intervalo, de modo que un punto en 0 nunca lleva un intervalo que no lo contenga ni una lectura distinta de «Sin diferencia detectable». Permutación de la etiqueta de cabecera dentro de cada noticia (1.000 réplicas), p bilateral, ajuste de Benjamini-Hochberg y número esperado de «diferencias detectables» por azar, publicado junto al mapa. Lectura fija de la sección 9: intervalo que cruza 0 o p ajustada > 0,05 → «Sin diferencia detectable»; signo opuesto en S1 o S2 → «Depende de la referencia»; si no → «Más a la izquierda que el conjunto» / «Más a la derecha que el conjunto». Sensibilidades en la misma celda, nunca cifra principal: S1 media simple de las demás en las mismas noticias; S2 estratificada por lado del prior externo («depende del prior externo»); S3 ponderada por audiencia con cifra pública; S4 con partidos, líderes y organizaciones enmascarados en el 20 % de los titulares (si cambia el signo, la lectura pasa a «depende del actor nombrado»); S5 por tema, plegada. Serie semanal: cada domingo se recalcula sobre los 90 días anteriores; los puntos que no cumplen los mínimos son huecos, y los cambios de método o de modelo se marcan como eventos.
Eje auxiliar de valencia. Para cada titular el modelo responde también si es crítico con el Gobierno central actual (en dos órdenes). Si en 90 días la correlación entre encuadre y crítica al Gobierno supera 0,8, la familia entera lleva el aviso «no distinguible de crítica al Gobierno central actual» y no se publica por cabecera en esa ventana; se publica la correlación.
11.4 Cómo neutralizamos al propio juez
- Anonimización: la cabecera no está en el prompt; test de cero fugas.
- Dos órdenes de escala con lectura de la distribución completa: cancela la preferencia del modelo por una letra o posición.
- Descriptor propio como ancla y como control: baja el error y separa agenda de encuadre a nivel de ítem; si el descriptor sale con carga, la noticia no se publica.
- Controles en cada corrida, todos con «Diario Ejemplo» y hechos inventados, en pareja espejo: tríos izquierda/descriptivo/derecha sobre la misma noticia (≥ 40), paráfrasis (≥ 10 pares, descriptivas y con carga: el mismo marco contado con otras palabras, a la izquierda y a la derecha; la diferencia mediana entre las que llevan carga define el suelo de ruido, porque dos redacciones descriptivas caen las dos en 0 y no miden nada), actor intercambiado (≥ 10 pares con partido o líder cambiado; la puntuación no debe moverse más de 0,25 en el 80 %), «no aplica» (≥ 6) y, cada mes, atribución (100 titulares con un prefijo falso «Titular de Diario Ejemplo A» de cada lado: mide cuánto «sabría» el juez de quién es). Cinco puertas (signo ≥ 0,8 en conjunto y ≥ 0,75 en cada uno de los cuatro tramos con signo, con al menos seis controles retenidos por tramo; ceros ≥ 0,8; «no aplica» ≥ 0,8; descriptores dentro de tolerancia ≥ 0,8; suelo de paráfrasis ≤ 0,25) sobre ítems retenidos, más la del actor enmascarado (punto 6). Retenido quiere decir ciego: la partición se calcula por el hash del hecho inventado (el hecho entero cae en la misma mitad), solo cuentan los ítems escritos en la versión 0.3 de la rúbrica sin haber mirado su resultado, y ningún retenido comparte cuatro palabras con contenido ni se parece más de un 75 % a un ejemplo de la rúbrica ni a un control de ajuste; el identificador de la partición que puntuó se publica con cada corrida. Si una corrida falla una puerta, no se publica nada de esa corrida y el panel conserva la última publicable con su fecha.
- Eje auxiliar de valencia (11.3) contra la confusión «oposición = derecha».
- Enmascarado de actores como sensibilidad S4.
- Permutación dentro de noticia y esperado por azar, y encogimiento hacia cero con pocos datos.
- Validación semanal por pares (juicio comparativo entre titulares de la misma noticia, solo como comprobación: se publica la concordancia de orden con la puntuación absoluta) y léxico parlamentario como contraste (concordancia de signo con la lista congelada de frases; nunca entra en el cálculo).
11.5 La rúbrica íntegra (versión 0.2)
Lo que el modelo recibe como instrucción, palabra por palabra, en la variante A = izquierda; la otra variante invierte la escala y las letras de los ejemplos y de la regla 2. Los titulares de los ejemplos son ⌗ EJEMPLO: inventados para la rúbrica, ninguno atribuido a una cabecera real. Parámetros fijos: temperatura 0, dos tokens de salida, distribución completa de la primera letra. La versión del prompt (VERSION_PROMPT) es una huella de este texto y de los parámetros; cualquier cambio es ruptura de serie y obliga a repetir controles y conjunto de validación.
Eres un analista de encuadre periodístico. Recibes UN titular de la prensa española (sin el nombre del medio) y, a veces, una descripción neutra de la misma noticia. Clasifica el ENCUADRE del titular en el eje izquierda-derecha del debate político español.
Puntúas CÓMO se cuenta la noticia, nunca QUÉ ocurre ni quién la protagoniza. Una subida de impuestos, una llegada de migrantes, una huelga o una manifestación no son de izquierda ni de derecha: lo es la forma de contarlas. Las pistas son tres: el vocabulario elegido, a quién se presenta como responsable o como víctima, y qué valor se invoca.
Encuadre de IZQUIERDA: derechos sociales y laborales, servicios públicos, redistribución, acogida, feminismo, memoria democrática, ecologismo, diálogo territorial; responsables: empresas, grandes fortunas, «la derecha», «la ultraderecha»; palabras como «personas migrantes», «precariedad», «recortes», «fondos buitre», «violencia machista», «privatización».
Encuadre de DERECHA: orden y seguridad, unidad de España, libertad económica, bajada de impuestos, familia y tradición, control de fronteras; responsables: «el Gobierno socialcomunista», «los separatistas», «los okupas», «los ilegales»; palabras como «invasión», «avalancha», «okupas», «chiringuitos», «infierno fiscal», «adoctrinamiento», «traidor».
DESCRIPTIVO: cuenta el hecho sin ese vocabulario ni esa atribución de culpa, aunque nombre a un político, a un partido o al Gobierno. Son descriptivas por sí solas, y no puntúan, palabras como «migrantes», «inmigrantes», «menores no acompañados», «regularización», «huelga», «manifestación», «feminista» (como adjetivo de una persona), «sanidad pública» o «impuestos»: lo que puntúa es el marco que las acompaña.
Ejemplos (misma noticia, tres formas de contarla):
Noticia: unas 300 personas entran a nado en Ceuta.
- «Cientos de personas migrantes llegan exhaustas a Ceuta y piden protección» → A
- «Unas 300 personas entran en Ceuta a nado, según la Delegación del Gobierno» → C
- «Avalancha de ilegales: la invasión de Ceuta desborda a la Policía» → E
Noticia: el Gobierno sube un impuesto.
- «El Gobierno hace pagar más a las grandes fortunas para sostener la sanidad» → A
- «El Consejo de Ministros aprueba subir el impuesto de patrimonio» → C
- «Sánchez vuelve a asfixiar a las familias con otra subida de impuestos» → E
Noticia: un juzgado ordena un desalojo.
- «Un fondo buitre desahucia a tres familias con niños» → A
- «Un juzgado ordena desalojar un edificio ocupado desde 2024» → C
- «Los okupas campan a sus anchas ante la pasividad de la ley» → E
Noticia: la oposición critica al Gobierno por el paro.
- «El PP y Vox usan el paro para atacar la reforma laboral que redujo la precariedad» → B
- «El PP critica los datos de paro de agosto» → C
- «El paro real sigue disparado pese al maquillaje de cifras del Gobierno» → D
Noticia: una comunidad autónoma acoge a menores migrantes.
- «Canarias tutela a 5.000 menores migrantes no acompañados, según el Gobierno regional» → C
Noticia: una manifestación con lemas contra el Gobierno.
- «Miles de personas se manifiestan contra el Gobierno: “¡Traidor!”» → D (la palabra es de la cita, no del titular)
- «Miles de españoles plantan cara al Gobierno traidor que vendió Ceuta» → E
Reglas:
1. Criticar al Gobierno o a la oposición no puntúa por sí mismo: puntúa el marco con que se critica.
2. Una cita entre comillas cuenta, porque elegir qué declaración va al titular es una decisión editorial, pero pesa menos que las palabras propias del titular: una cita que por sí sola sería A o E se queda en B o D si el titular la atribuye claramente («dice», «según», «Abascal:», dos puntos antes de las comillas). Si el mensaje del usuario indica «El titular atribuye la frase entrecomillada a un tercero», aplica esta regla.
3. N solo cuando el ASUNTO no tiene lectura política (tiempo, deportes, programación de televisión, sucesos sin lectura política, cultura sin polémica, obituarios). Un titular descriptivo sobre un asunto político es C, no N.
4. Responde SOLO con una letra.
Escala:
A = encuadre claramente de izquierda
B = encuadre que tiende a la izquierda
C = descriptivo, sin encuadre detectable
D = encuadre que tiende a la derecha
E = encuadre claramente de derecha
N = no aplica (asunto sin lectura política)
Mensaje del usuario: «Descripción neutra de la noticia: ‹descriptor propio› / Titular: ‹titular anonimizado› / [Pista: el titular atribuye la frase entrecomillada a un tercero.] / Letra:». La pista solo se incluye cuando nuestros rasgos deterministas del titular detectan una cita con atribución; no se aplica ningún factor de corrección después. Los controles con cita atribuida llevan la misma pista, para que las puertas midan exactamente el prompt de producción; se juzgan además sin ella y las dos tasas se publican con cada corrida.
Modelo: Gemma 4 E2B (pesos abiertos, licencia Apache-2.0), cuantización Q4_K_M, servido por llama.cpp en nuestro propio servidor; nombre, versión, cuantización y huella SHA-256 en modelos/MANIFEST.json; ningún servicio externo. A 5 de septiembre de 2026 este modelo no abre las puertas de 11.7 (signo 0,67, ceros 0,57, «no aplica» 0,63, descriptores 0,60 sobre los controles retenidos; umbral 0,8 en las cuatro), por lo que ninguna cifra por cabecera es pública. Se mejora la rúbrica (versión 0.3, con controles retenidos nuevos escritos antes de ver su resultado) y/o se repite la batería con un modelo local mayor (Gemma 4 E4B, Qwen3.5-4B); si ninguno las abre, la familia no se publica y esta página lo dice.
11.6 Cuándo se publica y cuándo no
| Nivel | Se publica si… | Si no, el panel muestra |
|---|---|---|
| Titular | Nunca solo: siempre dentro de su celda y de su noticia; nunca en la línea del pie de cita (firma · cabecera · hora) | — |
| Noticia (página de la noticia y tarjetas de Hoy) | ≥ 3 celdas · descriptor descriptivo · en ámbito · recorrido > 2 × suelo de ruido (el suelo nunca baja de 0,125: las cabeceras han de diferir al menos medio tramo) · juzgada por la rúbrica y el modelo vigentes · corrida con sus puertas en verde | «Encuadre: sin lectura» y un motivo fijo: «hacen falta 3 cabeceras con titular aplicable», «el descriptor no pasó su control», «las diferencias entre titulares no superan el ruido de paráfrasis», «asunto sin lectura política», «pendiente de la pasada nocturna» |
| Cabecera (ficha, mapa, serie) | ≥ 30 noticias compartidas · ≥ 20 días distintos con titulares de esa cabecera · panel con k = 8 (o 6 declarado) · validación automática abierta (las puertas de 11.7 en verde en las últimas siete corridas consecutivas de producción con la misma rúbrica y el mismo modelo; las pasadas de prueba de una rúbrica no cuentan) · valencia ≤ 0,8 · permite anotación · fuera de congelación electoral | «Sin datos suficientes» con progreso («12 de 30 noticias compartidas · 6 de 20 días») o el motivo: «validación automática pendiente», «controles fallidos», «sin anotación», «sin portada» |
| Mapa de medios | ≥ 12 cabeceras publicables | «Validación automática pendiente» mientras las puertas estén cerradas; después, «El mapa se publica cuando al menos 12 cabeceras superan 30 noticias compartidas y 20 días con datos; hoy llegan N de 24», con la lista de las que llegan y las que no |
| Corrida diaria | Las puertas de 11.7 (signo, ceros, «no aplica», descriptores, paráfrasis, actor enmascarado) sobre los controles retenidos | Nada de esa corrida; el panel conserva la última publicable con su fecha |
Sin anotación humana. No hay conjunto de validación humano para el encuadre (decisión del 5 de septiembre de 2026; 11.7). La cifra por cabecera se calcula cada noche y se muestra en nuestro panel de desarrollo marcada como provisional, para que podamos ver cómo se comporta; en público solo aparece cuando las puertas automáticas llevan siete corridas seguidas abiertas y hay datos suficientes, y entonces cada cifra lleva la marca «estimación con validación automática, sin anotación humana». El interruptor que permitía publicar sin validación (ENCUADRE_PUBLICAR_SIN_GOLD) sigue apagado en público y solo sirve al panel local. El encuadre por noticia no depende de la cifra por cabecera: se publica con sus propias puertas.
11.7 Validación automática, sin anotación humana: qué comprobamos y qué no garantiza
No hay conjunto de validación humano para el encuadre. El plan preveía 200 titulares anotados por personas que se sitúan en bloques distintos de la escala política; el 5 de septiembre de 2026 el responsable del proyecto decidió no hacerlo («la anotación de titulares no la vamos a hacer»). Lo decimos con esas palabras porque cambia lo que esta cifra puede garantizar, y por eso toda cifra de encuadre por cabecera lleva la marca «estimación con validación automática, sin anotación humana».
Qué significa, para un lector normal. Nadie ha leído una muestra de titulares reales y ha dicho, titular a titular, «esto es descriptivo» o «esto tira a la derecha» para compararlo con lo que dice el modelo. Lo que sí hacemos es comprobar el modelo contra cosas que podemos construir y repetir cada noche:
- Controles retenidos y ampliados. Titulares inventados sobre hechos inventados («Diario Ejemplo»), escritos en tríos —una versión de izquierda, una descriptiva, una de derecha— para la misma noticia, más pares de paráfrasis, pares con el partido o el líder intercambiado y titulares sin lectura política. Solo cuentan para las puertas los ítems escritos después de ver un fallo y no usados para redactar la rúbrica (retenidos): así la rúbrica no aprueba su propio examen. El conjunto crece cada mes con los patrones de fallo que veamos y con los casos que señalen los editores (reescritos con hechos inventados). Puertas: signo correcto ≥ 0,8 en conjunto y ≥ 0,75 en cada tramo (claramente izquierda, tiende a la izquierda, tiende a la derecha, claramente derecha; al menos seis retenidos por tramo); ceros correctos ≥ 0,8; «no aplica» ≥ 0,8; descriptores dentro de tolerancia ≥ 0,8; suelo de paráfrasis ≤ 0,25, medido también con paráfrasis con carga; actor enmascarado sin cambio de signo.
- Consistencia entre órdenes. Cada titular se juzga dos veces, con la escala en un sentido y en el contrario; un modelo que cambia de lado al invertir la escala no está leyendo el titular. Los inconsistentes cuentan como empate y su tasa se publica por cabecera.
- Enmascarado de actores (S4). En una parte de los titulares sustituimos partidos, líderes y organizaciones por marcadores genéricos y volvemos a juzgar; si la cifra de una cabecera cambia de signo, la lectura pasa a «depende del actor nombrado» y no se afirma.
- Pares semanales. Cada semana el modelo compara titulares de la misma noticia por parejas («¿cuál está más a la izquierda?»), con otro formato de pregunta; publicamos la concordancia (τ de Kendall) con las puntuaciones absolutas.
- Atribución y valencia. Con un prefijo falso de cabecera el desplazamiento debe ser ≤ 0,10 (mide cuánto «adivinaría» el modelo de quién es el titular); la correlación con «crítico con el Gobierno» debe ser ≤ 0,8 (si no, la familia se retira en esa ventana).
- Estabilidad y datos. Correlación de Spearman ≥ 0,8 entre las cifras de días pares e impares; ≥ 20 días con ≥ 12 cabeceras con n ≥ 30; fuera de congelación electoral.
Cuándo se abre. La cifra por cabecera sale al público solo cuando todas las puertas del punto 1 llevan siete corridas consecutivas en verde y se cumplen los puntos 5 y 6. A 5 de septiembre de 2026 no se abren (11.11): signo 0,67, ceros 0,57, «no aplica» 0,63, descriptores 0,60. Hasta entonces no hay cifra pública: hay un hueco con su progreso.
Qué no garantiza. Hay que decirlo entero:
- Errores sistemáticos compartidos. Si el modelo lee de forma sistemática cierto vocabulario como propio de un lado y nuestros controles comparten esa lectura —los escribimos nosotros, con nuestra rúbrica—, el error pasa las puertas sin que nadie lo vea. Un conjunto anotado por personas de posiciones distintas detectaría parte de eso; no lo tenemos.
- Los controles son más fáciles que la realidad. Son casos claros sobre hechos inventados; un 0,8 en controles no es un 0,8 en titulares reales, con ironía, citas y matices.
- El 0 no está anclado en lectores. No sabemos si un lector que se sitúa a la izquierda y otro que se sitúa a la derecha llamarían «descriptivo» a los mismos titulares que el modelo.
- La validez externa no valida. Publicamos cada trimestre la correlación de nuestras cifras con instrumentos ajenos (CIS 2023, MBFC, Guerrero-Solé) y los desacuerdos con nombre; miden cosas distintas (percepción de lectores, criterio de un ranker) y no entran en el cálculo.
Cómo lo mitigamos. Con lo de arriba y con lo que ya obliga el resto del método: el intervalo siempre junto a la cifra; gris y «Sin diferencia detectable» por defecto; lectura relativa al conjunto, nunca etiqueta; el dato crudo de cada celda cotejable por la propia cabecera; la réplica íntegra en tres días junto al bloque; la salida del cálculo a petición en menos de 15 minutos; y cualquier cambio de rúbrica, modelo o umbral como versión nueva con ≥ 50 controles retenidos nuevos escritos antes de ver su resultado. Si algún día hubiera anotación humana, se añadiría como versión nueva del método y se diría aquí; no la prometemos.
Después de publicar. Los controles se repiten íntegros ante cualquier cambio de pesos, prompt, binario, cuantización o umbral; 50 controles nuevos al mes desde «¿Falta alguna cabecera?» y desde las réplicas de editores; informe trimestral con todas las tasas de 11.8 y la validez externa como contraste. Nada de ello entra en el cálculo.
11.8 Las tasas que publicamos
Se rellenan con las corridas sobre los controles retenidos y se actualizan en cada informe trimestral de calidad. Las únicas cifras medidas hoy son las de los controles del 5 de septiembre de 2026 (11.11), que precisamente por ellas mantienen la familia sin publicar; el resto figura como pendiente. No hay tasas de acuerdo con anotadores humanos porque no los hay (11.7), y lo decimos en la tabla.
| Medida | Definición | Umbral o condición | Valor vigente |
|---|---|---|---|
| Acuerdo entre anotadores humanos (α) y acuerdo modelo-humanos (κ) | No se miden: el encuadre no tiene anotación humana (11.7) | — | no aplica |
| Controles retenidos: signo correcto | Tríos izquierda/descriptivo/derecha sobre hechos inventados, solo ítems retenidos | ≥ 0,8 | 0,67 (5-9-2026, Gemma 4 E2B) |
| Controles retenidos: ceros correctos | Titulares descriptivos de los controles que el modelo deja en |s| ≤ 0,25 | ≥ 0,8 | 0,57 (5-9-2026) |
| Controles retenidos: «no aplica» | Titulares sin lectura política que el modelo marca N | ≥ 0,8 | 0,63 (5-9-2026) |
| Controles retenidos: descriptores dentro de tolerancia | Descriptores de control que el modelo deja en |s| ≤ 0,25 | ≥ 0,8 | 0,60 (5-9-2026) |
| Controles retenidos: signo correcto por tramo | Lo mismo, en cada uno de los cuatro tramos con signo (≥ 6 retenidos por tramo) | ≥ 0,75 en todos | por medir |
| Suelo de paráfrasis | Diferencia mediana entre dos redacciones del mismo hecho con el mismo encuadre, medida en los pares con carga (los descriptivos se publican aparte) | ≤ 0,25 | 0,26 (5-9-2026, Gemma 4 E4B, 6 pares retenidos con carga): cerrada |
| Corridas consecutivas con todas las puertas abiertas | Condición de publicación de la cifra por cabecera | ≥ 7 | 0 |
| Concordancia con los pares semanales | τ de Kendall entre el orden por pares y las puntuaciones absolutas, por noticia | publicada | pendiente |
| Efecto del enmascarado de actores (S4) | Cabeceras cuya cifra cambia de signo con los actores enmascarados | ninguna publicable con cambio de signo | pendiente |
| Inconsistencia entre órdenes | Titulares que cambian de lado al invertir la escala, por cabecera y versión | publicada | pendiente |
| «No aplica» | Titulares sin lectura política, por cabecera | publicada | pendiente |
| Descriptores con carga | Descriptores que no salen descriptivos en su control | < 10 % en la ventana | pendiente |
| Piezas fuera de pertenencia y teletipos compartidos | Excluidas por no hablar de la misma noticia; celdas con puntuación copiada de un teletipo | publicadas | pendiente |
| Historias fuera de ámbito, por capa | Sección, descriptor «no aplica», actor no público | publicadas | pendiente |
| Diferencias detectables esperadas por azar | Permutación dentro de noticia, 1.000 réplicas | publicada junto al mapa | pendiente |
| Correlación encuadre-crítica al Gobierno | Spearman entre s y valencia en historias con actor político | ≤ 0,8 para publicar por cabecera | pendiente |
| Carga léxica simétrica y atribución | |Δs| con actor intercambiado; desplazamiento con prefijo falso | ≤ 0,25 en ≥ 80 % · ≤ 0,10 | pendiente |
| Estabilidad temporal | Spearman entre β de días pares e impares | ≥ 0,8 | pendiente |
| Validez externa | Spearman con CIS 2023, MBFC y Guerrero-Solé, y desacuerdos con nombre | publicada, nunca entrada | pendiente |
11.9 Cómo se lee
- La cifra por cabecera es relativa al conjunto, no al descriptor. Un ejemplo ⌗: si en un día casi todas las cabeceras titulan una noticia con vocabulario de la derecha, una agencia que la cuente de forma descriptiva sale ese día «a la izquierda del conjunto», aunque su titular esté en el 0 de la escala absoluta. La posición absoluta (anclada en el descriptor) se enseña en la página de cada noticia; la relativa (respecto a las demás en las mismas noticias) en la ficha de cabecera y en el mapa. Las dos son ◆ y las dos se explican en el propio panel.
- «Cómo se lee», el párrafo que acompaña a cada cifra de tendencia (⌗ con Diario Ejemplo A): «En las 386 noticias que Diario Ejemplo A compartió con las demás cabeceras en los últimos 90 días, el encuadre de sus titulares quedó de media 0,42 puntos a la izquierda del conjunto, en una escala de −1 a +1. El intervalo dice cuánto podría moverse esa cifra por azar; si tocara el 0 diríamos “sin diferencia detectable”. No es una nota ni una etiqueta: mide titulares, no la ideología de nadie.»
- «Sin diferencia detectable» es el estado más frecuente y esperable: significa que, con los datos disponibles, no distinguimos los titulares de esa cabecera de los del conjunto. El marcador se pinta en gris. «Depende de la referencia» significa que el modelo y alguna sensibilidad no coinciden en el lado: no se afirma ninguno.
- Por noticia mostramos bandas, no puntos, y los titulares ordenados de izquierda a derecha con su razón corta («Sujeto Policía; verbo investigar; palabras que el modelo tenía delante: invasores; cita atribuida») y sus chips de rasgos. Por noticia la lectura orienta, no separa: dos cabeceras con bandas que se solapan no se distinguen.
- El mapa no es un ranking y por eso la lista se ordena alfabéticamente, no por valor; no hay «n.º de 24» ni zonas con nombre; el pie dice cuántas diferencias detectables hay y cuántas se esperarían por azar. Con pocas noticias las cifras encogen hacia el 0 y con menos de 30 noticias o 20 días no hay cifra, hay hueco.
11.10 El mapa de medios
Está en la portada del sitio (Hoy). Muestra todas las cabeceras con datos suficientes, agrupadas en carriles por familia (grandes grupos · nativos digitales · económicos · referencia). Cada cabecera es un punto (su estimación central, β encogido; el radio crece con el número de noticias) con una barra (su intervalo del 95 %: cuanto más larga, menos seguro), etiquetada con su nombre completo. El 0 es el conjunto de cabeceras medidas, no una línea de realidad; la rejilla marca −1, −0,5, 0, +0,5 y +1 y los polos se escriben en los extremos. Las cabeceras de referencia (agencias y RTVE) van con punto hueco: se miden con la misma regla, no se puntúan como el resto. No hay lavado de color de fondo ni columnas de zona. El pie dice «N cabeceras con datos suficientes · k diferencias detectables · m esperadas por azar». Tiene un gemelo en lista (nombre · mini-eje con intervalo · valor con IC), ordenada alfabéticamente, que es la vista en móvil. Mientras haya menos de 12 cabeceras publicables no hay mapa: hay un medidor de progreso con las que ya llegan y las que no.
11.11 Registro de versiones del método de encuadre
| Versión | Fecha | Qué cambió | Ruptura de serie |
|---|---|---|---|
juez-rubrica/0.1 (prototipo) |
2026-09-04 | Prototipo en solo lectura sobre la base de desarrollo: 265 titulares de 78 historias, 747 llamadas en 206 s. Controles sintéticos: signo correcto 9/14, ceros 6/7, «no aplica» 2/2. Fallos sistemáticos: citas atribuidas leídas como marco propio, «migrantes» disparando el marco de izquierda, tema confundido con marco. No se estrena. | — |
encuadre-juez/0.2 |
2026-09-04 (decisión) | Línea DESCRIPTIVO ampliada; pista de cita en el prompt (sin factor en posproceso); regla 3 con obituarios; controles retenidos y puertas como código; eje de valencia; pertenencia; enmascarado de actores; dedupe de teletipos; encogimiento; validación automática como condición de publicación (desde el 5-9-2026; el gold de 200 con anotadores de autoubicación distinta previsto el 4-9 no se hará). VERSION_PROMPT se publica aquí al fijarse en código. |
Primera versión: no hay serie anterior |
encuadre-juez/0.2 (medición) |
2026-09-05 | Controles retenidos con Gemma 4 E2B: signo 0,67 · ceros 0,57 · «no aplica» 0,63 · descriptores 0,60 (umbral 0,8) → puertas cerradas; ninguna cifra por cabecera publicada. Decisión del 5-9-2026: el conjunto de validación humano se sustituye por la validación automática (11.7) y la recogida pasa a las 28 cabeceras accesibles (sección 2). | Sin serie pública que romper |
| rúbrica 0.3 + Gemma 4 E4B (medición con controles ciegos) | 2026-09-05 | Rúbrica 0.3 (línea DESCRIPTIVO ampliada, trampa del actor, citas, ejemplos por tramo) y paso del juez a Gemma 4 E4B; 194 controles nuevos escritos antes de medir, partición reproducible por descriptor y solo ciega, G1 también por tramo. En los 143 retenidos ciegos: signo 0,708 · −1,0 0,714 · −0,5 0,882 · +0,5 0,250 · +1,0 0,944 · ceros 0,958 · «no aplica» 1,000 · descriptores 0,929 · ρ_0 con carga 0,264 · actor 0,889 → no publicable (G1 por tramo y G5). El método sigue en encuadre-juez/0.2: ningún umbral cambió. |
Cambia VERSION_PROMPT y el modelo: todo se vuelve a juzgar; sin serie pública que romper |
| rúbrica 0.4 (+ Gemma 4 12B medido) | 2026-09-07 | Rúbrica 0.4 ajustada solo con la partición de ajuste (tres pasos: asunto → carga → lado e intensidad; dos registros por lado con el moderado de derecha explícito; la cita baja un tramo y nunca a C); 60 controles ciegos nuevos (33 retenidos: 176 en total). Medición única en retenidos de cuatro combinaciones: Gemma 4 E4B con 0.3 → signo 0,707 (+0,5 en 0,238), con 0.4 → 0,756 (+0,5 en 0,476, actor 0,583); Gemma 4 12B (Q4_K_M, candidato) con 0.3 → 0,805 pero −0,5 en 0,571 y «no aplica» 0,750, con 0.4 → signo 0,854 con los cuatro tramos ≥ 0,75, ceros 1,000, descriptores 1,000, ρ_0 0,000, actor 1,000 y «no aplica» 0,750 (9/12). Ninguna combinación abre las seis puertas: no se publica ninguna cifra por cabecera. Queda la 0.4 en el código y E4B como juez; el 12B, registrado y no desplegado (11,5 GB residentes, 2-3× más lento). Informe: metodologia/informes/juez-0.4-2026-09-07.md. |
Cambia VERSION_PROMPT (j2-c70d0c9e1074); sin serie pública que romper |
11.12 Qué no mide y límites conocidos
No mide verdad, calidad ni intención; no mide la ideología de nadie; no mide qué temas cubre cada medio (eso es atención y prominencia); no mide el cuerpo del artículo (solo el titular vigente, lo que el lector ve en portada); no puntúa periodistas; no usa el prior externo en ningún cálculo; no produce ranking. Límites que declaramos: el titular es poco texto (la entradilla no entra en esta versión); el modelo tiene unos 2.000 millones de parámetros y falla en ironía, paralelismos y citas; hereda los errores de la agrupación en historias (la métrica no puede ser mejor que el clustering); criticar al Gobierno no puntúa por sí mismo, pero el cambio de incumbencia de 2027 se vigila con el eje de valencia y la regla 1; y ninguna dimensión se estrena ni cambia de método dentro de una congelación electoral (sección 15). Y el mayor de todos: no hay anotación humana del encuadre; la validación es automática, con los límites que 11.7 detalla, y así se marca en cada cifra.
11.13 Qué hacemos si un editor discrepa, y cómo puede replicar cualquiera
Si una cabecera discrepa de una cifra: (1) le damos el dato crudo de sus celdas —para cada noticia, el descriptor, sus piezas por huella y hora, las letras del modelo en los dos órdenes y la puntuación—, cotejable con sus propios titulares; (2) le explicamos la lectura y el intervalo (si su cifra está en «Sin diferencia detectable» o «Sin datos suficientes», el sitio ya lo dice); (3) los casos que señale se convierten en controles retenidos (reescritos con hechos inventados y «Diario Ejemplo», sin reproducir su titular) y, si el modelo fallaba, lo publicamos; (4) su réplica se publica íntegra en 3 días en su ficha, junto al bloque de tendencia (Réplicas); (5) puede pedir «sin anotación de modelo» en Editores: sus titulares dejan de entrar en el encuadre en menos de 15 minutos, su ficha lo dice y la cobertura sigue contándolos. Lo que no hacemos: cambiar la rúbrica para un caso ni retirar una cifra sin corrección pública.
Para replicar los números hace falta: los ficheros abiertos encuadre_titular (huella del titular, letras, puntuación, probabilidad de «no aplica», inconsistencia, valencia, versión), encuadre_historia_cabecera y encuadre_cabecera en Datos, sin texto de titular; la rúbrica de 11.5 y el modelo pinzado por su huella en modelos/MANIFEST.json, servido con llama.cpp en local; y el código del repositorio (hemeroscopio encuadrar para juzgar, hemeroscopio controles-encuadre para ejecutar solo los controles, hemeroscopio agregar para la cifra por cabecera). Un editor puede comprobar sus propias celdas calculando la huella SHA-256 de sus titulares con la normalización descrita en el diccionario de variables. Si obtienes otra cosa, cuéntanoslo: irá a Correcciones.
12. Qué NO medimos
- La ideología de nadie. Estimamos el encuadre de titulares (sección 11) y lo publicamos como desviación respecto al conjunto, con intervalo; no publicamos una categoría ni un adjetivo de ninguna cabecera, ni nada de ninguna persona. El tono por actor (versión 1.1) solo se publicará si el límite inferior del intervalo de la fiabilidad entre anotadores humanos (α de Krippendorff) es ≥ 0,667 en el bloque de anotadores más bajo; la proximidad léxica (versión 1.2) solo sobre una lista de frases congelada con hash antes de contar y solo para cabeceras con cuerpo abierto leído en ≥ 60 % de sus artículos compartidos. Fechas y condiciones, en el registro de cambios.
- Verdad, fiabilidad o calidad: no verificamos hechos ni damos notas. Tampoco contamos verificaciones ajenas.
- Personas: nada sobre periodistas; solo figuras públicas con cargo, y siempre como conteo por cabecera.
- La omisión del cuerpo: no almacenamos texto, así que no podemos medir qué falta dentro de un artículo; en la versión 1.1 mediremos «hechos en titular y entradilla», que es lo que el instrumento ve, y lo diremos así.
- La posición de El País y de Cinco Días, si sus servidores siguen bloqueando la captura de portada: no la sorteamos. Ni el léxico de las cabeceras sin cuerpo abierto.
- Grupos de afinidad cuando no son estables: entonces no hay grupos.
- Consumo informativo: la muestra son cabeceras, no lectores.
13. Tasas de error que publicamos
Se rellenan con los datos (fase 2, hasta febrero de 2027) y se actualizan en el informe trimestral de calidad. Hasta entonces figuran como pendientes. Las del encuadre están en la sección 11.8.
| Medida | Definición | Umbral o condición | Valor vigente |
|---|---|---|---|
| Recall de descubrimiento, por cabecera | Fracción de artículos publicados que detectamos por feed o sitemap (muestra semanal) | ≥ 0,9 para permitir el estado «no detectada» | pendiente |
| Recall de asignación a historia, por cabecera | Fracción de artículos del día-gold que el modelo asigna a la historia correcta | ≥ 0,9 para permitir «no detectada» | pendiente |
| F1, BCubed y ARI del clustering | Frente a 300 pares anotados y un día completo agrupado a mano | F1 ≥ 0,85; se publica junto al techo humano-humano (una segunda persona agrupa el 20 % de forma independiente) | pendiente |
| Fragmentación | Historias que el modelo parte en dos o más | < 10 % | pendiente |
| Falsos «no detectada» | Estimados en el conjunto de referencia | < 2 % para activar el bloque evaluativo | pendiente |
| Exactitud de rasgos del titular | Sujeto, verbo, nivel de atribución frente a 300 titulares anotados por dos personas | sujeto ≥ 0,85 | pendiente |
| Descriptores aceptables | Fidelidad, ausencia de valoración, cifras consensuadas, lexicón; 100 historias, dos personas | ≥ 90 % o vuelta al modo manual; tasa de rechazo por lexicón publicada | pendiente |
| Par de titulares más distintos | Coincidencia de dos personas con el par del modelo o su top-3 en 30 historias | ≥ 70 % | pendiente |
| Exactitud de tema (IPTC nivel 1) y acuerdo de tipo de fuente | 200 artículos y 200 titulares + entradillas, dos personas | publicados por cabecera | pendiente |
| Oscilaciones de titular (pruebas A/B) | Porcentaje de cambios marcados como probable A/B, por cabecera | > 30 % en un día → nota | pendiente |
| Estabilidad de posición | τ y RBO sobre la intersección de dos capturas, a dos horas | < 0,90 → bandas puras | pendiente |
| Correlación DOM-visual y exactitud de bandas | Validación visual trimestral, 10 portadas × cabecera, 1280 y 390 px | publicada por cabecera | pendiente |
| Diferencias esperadas por azar | Por familia y ventana, 1.000 permutaciones | publicada junto a cada familia | pendiente |
| Composición nominal y efectiva | Por familia y ventana | 50/30; «al límite» al 50 % | pendiente |
| Huecos, exclusiones, horas y coste | Del informe de calidad | publicados | pendiente |
14. De la sección declarada al tema
La sección que declara cada cabecera (■) se traduce a un tema de la taxonomía IPTC Media Topics (niveles 1-2) mediante una tabla de correspondencia por cabecera (config/iptc.yaml, publicada en el repositorio) y un clasificador local. El tema es ◆ y lo seguirá siendo aunque exista conjunto de referencia; lo único ■ es la sección declarada.
15. Congelación electoral y rupturas de serie
Ninguna dimensión ◆ se estrena ni cambia de método en los 60 días anteriores a unas elecciones generales o a la cita conjunta de municipales y autonómicas, ni durante su campaña; 15 días para autonómicas sueltas (y, mientras no se decida otra cosa, 60 para las europeas). Los ■ siguen. Esto vale también para el encuadre y la tendencia estimada: su estreno público y cualquier cambio de rúbrica, modelo o umbral se sitúan fuera de esos periodos. Cualquier cambio de método, de umbral, de lista de frases o de composición que afecte a una serie se anota aquí y en los datos como ruptura de serie; no se recalcula hacia atrás salvo que se diga, y entonces con la ruptura marcada.
16. Datos, código y protocolo registrado
- Código abierto (AGPL-3.0) y datos abiertos (CC BY 4.0): Datos. Sin titulares literales, sin firmas, sin el valor del prior.
- Protocolo registrado con datos ya en recogida: antes de la beta (abril de 2027) depositamos en OSF este método como protocolo, con hipótesis y variables, declarando qué se ha visto ya (umbral θ, métricas iniciales, tabla de potencia) y qué decisiones se tomaron con datos, junto con el hash del código. No lo llamamos «pre-registro» porque llega tras seis meses de datos. El protocolo de la proximidad léxica se registra al cierre de la fase 2 con un periodo ciego de 90 días; el del tono, antes de la versión 1.1; el del encuadre de titulares, con la rúbrica fijada en código y los controles retenidos y las puertas automáticas declarados antes de publicar la primera cifra por cabecera.
- Informe trimestral de calidad e informe anual de metodología con DOI.
- Carácter investigador: buscamos una carta de colaboración con un grupo universitario; si no está firmada al abrir la beta, los titulares literales permanecen apagados hasta que lo esté o hasta que el dictamen concluya que la cita analítica no la necesita.
17. Preguntas frecuentes
¿Medís el sesgo?
No damos una nota de sesgo, y es deliberado. «Sesgo» presupone una línea recta —la realidad, la neutralidad— respecto a la cual una cabecera se desvía, y nadie tiene esa línea: ni nosotros, ni los rankers extranjeros que puntúan la prensa española con diez titulares por medio, ni las encuestas que miden cómo la perciben los lectores (y que, por cierto, no coinciden entre sí). Lo que sí podemos medir, y medimos, es la desviación de cada cabecera respecto al conjunto de cabeceras medidas en las mismas noticias: qué cubre y qué no detectamos en su portada, con qué prominencia, cómo cambia sus titulares, con quién coincide y, desde la versión 0.10.0, cómo encuadra sus titulares. Eso es simétrico (todas se miden con la misma regla) y descriptivo (no dice quién tiene razón).
Sobre el encuadre, para que no haya confusión: no publicamos una nota de sesgo. Publicamos una estimación, con intervalo, de hacia dónde se sitúan los titulares de una cabecera respecto a los de las demás en las mismas noticias, y explicamos aquí cómo se calcula y cuánto se equivoca. No es lo mismo: no hay línea base de realidad, no hay ranking y una cabecera puede estar «a la izquierda del conjunto» un trimestre y no distinguirse del conjunto el siguiente.
La ideología es aquí un resultado, nunca un insumo: la única posición ideológica que usamos (sección 3) es un dato ajeno citado, con reglas de corte mecánicas, y sirve solo para que la muestra no esté desequilibrada y para un análisis de sensibilidad que lleva su etiqueta. No entra en ninguna cifra principal, tampoco en el encuadre: el modelo que lee los titulares no sabe de qué cabecera son.
Cuando la gente pregunta por «el sesgo» suele querer saber dos cosas más: si una cabecera elige unas noticias y no otras (eso es la atención por actor y la cobertura, y las medimos), y si las cuenta con un tono favorable o desfavorable hacia alguien (eso lo mediremos en la versión 1.1 solo si los anotadores humanos de posiciones distintas se ponen de acuerdo lo suficiente; si no, no se publica). Nunca publicaremos una nota única ni un ranking: un número que resuma a una cabecera es exactamente lo que el método no puede sostener.
¿Decís que un medio es «de izquierdas» o «de derechas»?
No, y hay un test que falla si lo hiciéramos. Decimos que, en las N noticias que una cabecera compartió con las demás en 90 días, el encuadre de sus titulares quedó de media a un lado del conjunto, con este intervalo; o que no se distingue del conjunto. Es una afirmación sobre titulares, acotada en el tiempo y con su incertidumbre, que cualquiera puede recalcular. No hay zonas con nombre en el eje ni adjetivos en la ficha.
¿Por qué rojo y azul?
Porque es la convención del debate español (y la contraria a la anglosajona, por eso escribimos los polos en cada eje). El color solo pinta el eje del encuadre —marcadores, puntos, pistas y el texto de los polos—, nunca fondos, nombres de cabecera ni nada más del sitio. El centro y todo lo que no se distingue del cero van en gris: el gris es el estado por defecto. Los dos polos tienen la misma luminosidad para que ninguno pese más. Nada parpadea ni se anima: la última pasada se indica con su hora.
¿Qué significa «estimación con validación automática, sin anotación humana»?
Que la cifra la produce un modelo y que lo único que la comprueba son controles que también construimos nosotros y que el modelo pasa o no pasa cada noche (sección 11.7): titulares inventados con respuesta conocida, la misma pregunta con la escala al revés, los actores enmascarados, comparaciones por parejas. Ninguna persona ha anotado titulares reales para contrastarla. Eso tiene un coste que decimos entero en 11.7: un error que el modelo y nuestros controles compartan no lo detectaríamos. Por eso la cifra solo sale cuando todas las puertas llevan siete noches abiertas, siempre con su intervalo, en gris cuando no se distingue del conjunto, y con esta marca al lado. Mientras las puertas están cerradas —hoy lo están— el mapa muestra su progreso y las fichas dicen «Validación automática pendiente», sin cifra.
¿Por qué no sois «neutrales»?
Porque «neutral» promete un punto de vista desde ninguna parte, y eso no existe. Somos simétricos y descriptivos: la misma regla para todas, el dato crudo a un clic, los ejemplos siempre en pareja espejo, el código y los datos abiertos, y la posición del autor publicada si él lo decide. Es más comprobable que una promesa de neutralidad.
¿Por qué RTVE y las agencias están fuera de las comparaciones?
Las medimos con las mismas reglas, pero las dejamos fuera del denominador porque no compiten en el mismo mercado ni con la misma lógica editorial; y publicamos todo ◆ también con ellas dentro, como sensibilidad, en el informe anual. Ninguna es una línea base. En el mapa de medios van con punto hueco.
¿Por qué faltan cabeceras?
elEconomista bloquea a nuestro bot (responde 403 incluso a robots.txt) y no lo sorteamos; le hemos pedido una lista blanca. El País y Cinco Días se recogen por sus feeds y sitemaps; su portada puede quedar «sin posición» si su servidor bloquea la captura, y tampoco lo sorteamos. Las deportivas y regionales quedan fuera por criterio. Si crees que falta una cabecera generalista nacional, escríbenos.
¿Puedo reproducir vuestros números?
Sí: con los Parquet de Datos, el código del repositorio y este protocolo (para el encuadre, además, el modelo pinzado y la rúbrica de 11.5). Si obtienes otra cosa, cuéntanoslo: irá a Correcciones.
18. Glosario
- Cabecera: cada diario digital medido. Es la unidad de análisis; nunca una persona.
- Historia / noticia: el grupo de artículos de distintas cabeceras que cuentan la misma noticia, según nuestra agrupación (◆). En el panel se llama «noticia».
- Descriptor propio: la descripción de ≤ 12 palabras que un modelo local redacta para cada noticia, sin copiar cinco palabras seguidas de ningún titular (◆). Es el 0 del eje en la vista por noticia.
- Conjunto de cabeceras medidas: todas las cabeceras con datos válidos en una ventana, sin las de referencia. Es el 0 de toda métrica comparativa: no existe línea base de realidad.
- Banda (posición): apertura · posiciones 2-10 · posiciones 11-30 · resto de la portada; solo cuenta si se sostiene dos capturas.
- Encuadre: cómo se cuenta un hecho en el titular (vocabulario, responsable o víctima, valor invocado), en el eje izquierda-derecha del debate político español, de −1 a +1 (◆).
- Banda (encuadre): en la vista por noticia, el mínimo y el máximo de las piezas de una cabecera; con una sola pieza, ±0,25.
- Tendencia estimada: la desviación media de los titulares de una cabecera respecto al conjunto en las mismas noticias, en 90 días, con intervalo (◆). No es una nota ni una etiqueta.
- Intervalo (del 95 %): el margen dentro del cual la cifra podría moverse por azar; si toca el 0, «Sin diferencia detectable». Cuanto más largo, menos seguro.
- n: cuántas noticias (o piezas, o días) hay detrás de una cifra. Sin n suficiente no hay cifra, hay hueco.
- Sin diferencia detectable: la lectura por defecto cuando el intervalo cruza el 0 o la p ajustada supera 0,05; el marcador va en gris.
- Depende de la referencia: el modelo y alguna sensibilidad no coinciden en el lado; no se afirma ninguno.
- Sin datos suficientes / validación automática pendiente: la cabecera no llega a 30 noticias compartidas y 20 días, o las puertas automáticas (11.7) no llevan siete corridas abiertas; se muestra el progreso, no una cifra.
- Esperado por azar: cuántas «diferencias detectables» aparecerían barajando la etiqueta de cabecera dentro de cada noticia; se publica junto a cada familia y junto al mapa.
- Referencia (cabecera de): agencias y RTVE; se miden con la misma regla y quedan fuera del denominador.
- Familia (de cabeceras): grandes grupos, nativos digitales, económicos y referencia; solo para agrupar en el mapa, no entra en ningún cálculo.
- Conjunto de referencia («gold»): los ítems anotados por personas con los que medimos cuánto se equivoca un modelo (agrupación, rasgos, descriptores, posición, tema: sección 13). El encuadre no tiene: se valida de forma automática (11.7).
- Validación automática: las comprobaciones sin anotación humana que deciden si la cifra de encuadre por cabecera se publica: controles retenidos con puertas, consistencia entre órdenes, enmascarado de actores, pares semanales, atribución y valencia (11.7).
- Corrida: una ejecución nocturna del método; si falla sus controles, no publica nada y el panel conserva la anterior.
- Ruptura de serie: un cambio de método, modelo, umbral o lista que impide comparar antes y después; se marca en los datos y en la serie.
- ■ / ◆ / ⌗: medido / estimado / ejemplo (sección 1.1).
19. Registro de cambios
| Versión | Fecha | Cambio |
|---|---|---|
| 0.9.0 | 2026-09-03 | Protocolo inicial, escrito antes de la recogida (28-9-2026). Pendientes: tabla de prior completa (con config/cabeceras.yaml), tasas de error (fase 2), resultado de la nota jurídica previa (oleada A2) y del dictamen (interruptores de titulares), lista de rotación alta y estado «sin posición» (semana 0). |
| 0.9.1 | 2026-09-04 | Aclaraciones tras la primera ejecución del código, sin cambio de método: la agrupación decide solo por similitud de vectores cuando no hay entidades reconocidas (provisional, a calibrar con el conjunto de referencia); una historia deja de admitir artículos 72 horas después de su última incorporación (el corte de anotación sigue a 48 horas); el histórico de 30 días de Estado queda como pendiente hasta la beta. |
| 0.10.0 | 2026-09-04 | Nueva familia ◆: encuadre de los titulares y tendencia estimada (sección 11, método encuadre-juez/0.2), por decisión del 4-9-2026: eje «izquierda-derecha del debate político español», rojo = izquierda y azul = derecha, escala −1…+1, rúbrica íntegra, controles, puertas, conjunto de validación de 200 titulares como condición de publicación pública por cabecera y estado «en calibración» hasta entonces. Sección 1.1 con las tres marcas (■ ◆ ⌗), familias de cabeceras, mapa de medios, glosario, FAQ ampliada («¿Medís el sesgo?», «¿Decís que un medio es de izquierdas o de derechas?», «¿Por qué rojo y azul?», «¿Qué significa en calibración?»). Vocabulario del panel: «Noticias» en lugar de «Historias»; «Última pasada HH:MM». Renumeración de las secciones 11-19. Sin cambio en las métricas existentes. |
| 0.11.0 | 2026-09-05 | Decisión del 5-9-2026 (Enmienda 02 al plan): la recogida pasa a las 28 cabeceras accesibles, incluidas las nueve con reserva de minería de textos (sección 2); el conjunto de validación humano del encuadre no se hará y se sustituye por la validación automática (11.7), con la marca «estimación con validación automática, sin anotación humana» y el hueco «Validación automática pendiente» en lugar de «en calibración» (11.6, FAQ, glosario); tasas de 11.8 reescritas con las medidas del 5-9-2026 (puertas cerradas); 11.11 con la medición y la 0.3 en preparación; 11.13 (casos de editores → controles retenidos). Sin cambio en las métricas existentes ni en la rúbrica 0.2. |
| 0.11.1 | 2026-09-05 | Alta de ESdiario y Economía Digital (sección 2; metodologia/informes/cabeceras-nuevas-2026-09-05.md): 31 cabeceras configuradas, 26 medidas. La Información no se da de alta porque es el vertical económico de 20minutos desde mayo de 2024. Sin cambio en las métricas ni en el método. |
| 0.12.0 | 2026-09-08 | Decisión del 8-9-2026 (Enmienda 03 al plan): los titulares literales se publican por defecto en la página de cada noticia y en su embed, con fuente, firma si consta, hora y enlace, ocho como máximo (sección 6), con el argumento de las excepciones de hipervínculo y «extractos muy breves» del art. 129 bis LPI y de los dos requisitos del art. 32.1 párrafo segundo que aquí no se dan; lo que una cabecera declara en su aviso legal se publica como información y deja de funcionar como interruptor (secciones 2 y 6); los titulares se apagan solo por petición del editor (≤ 15 min), Disallow por nuestro nombre, caducidad a 24 meses o el interruptor global. Sin cambio en las métricas, en la rúbrica ni en lo que se guarda: el cuerpo, la entradilla y el HTML siguen sin guardarse ni publicarse nunca. Límite declarado: «extracto muy breve» no está delimitado por los tribunales españoles y el dictamen jurídico sobre esta cuestión sigue pedido. |