Transparencia · metodología
ProCivica lee el texto de cada iniciativa y lo evalúa en cuatro ejes sustantivos de política pública. Combinados, esos ejes ubican la propuesta en una de siete bandas ideológicas. Aquí explicamos qué mide cada categoría, qué evidencia usamos y qué limitaciones tiene la lectura.
El panel público de /inicio reúne varios instrumentos — cada uno con su propia ventana de tiempo y su propia fuente oficial. Cada panel enlaza aquí desde su «Cómo lo medimos». Esto es lo que mide cada uno.
Cada iniciativa de la legislatura LXVI ubicada en su fase vigente: presentada, comisión, discusión, aprobación, revisora y sanción/DOF. Una fase que no observamos se marca como cobertura pendiente — nunca se rellena en verde.
Los órganos que más publican en el Diario Oficial de la Federación durante la semana ISO en curso. Cuenta entradas del DOF agrupadas por órgano emisor.
Las figuras federales más mencionadas por la prensa nacional en los últimos 7 días. La mención se atribuye al actor canónico, no al texto del nombre, con regla de empate explícita y fragmento literal.
De qué temas habló la conferencia matutina de la Presidencia esta semana, sobre las ocho categorías canónicas de política pública.
Qué temas cubrió la prensa nacional esta semana, sobre las mismas ocho categorías — para comparar la agenda mediática con la de la mañanera, fila por fila.
Las votaciones nominales del pleno de la semana en curso, con su desglose favor / contra / abstención. Entre periodos ordinarios la sección queda honestamente vacía.
Los decretos publicados en las últimas 72 horas — Diario Oficial federal y gacetas oficiales estatales con cobertura.
Los asuntos resueltos por la Suprema Corte en los últimos 30 días, con su materia y su ministro ponente.
Una búsqueda guardada — un tema, un legislador, una comisión — que avisa por correo cuando aparece una coincidencia nueva en una iniciativa, un voto, un decreto o la prensa. Requiere una cuenta.
Para cada iniciativa publicada en la Gaceta, leemos el texto completo — exposición de motivos, decreto y transitorios — y buscamos posiciones sustantivas de política pública. No clasificamos por partido autor ni por coalición: la posición debe estar en lo que la iniciativa propone hacer, no en quién la firma.
Cada propuesta puede tocar uno o varios ejes. La señal en cada eje se basa en categorías de política comparada (proyecto MARPOR / Manifesto Project) adaptadas al léxico legislativo mexicano. La combinación de los ejes ubica la iniciativa en una de siete bandas que van de izquierda extrema a derecha extrema, con un centro neutro al medio.
Una iniciativa que no toca ningún eje sustantivo se queda sin clasificar: no le asignamos banda. Preferimos no etiquetar antes que inventar una posición a partir del partido autor.
Cada eje tiene dos polos opuestos. La iniciativa se desplaza hacia el polo izquierdo o derecho del eje según las posiciones de política pública que articule en su texto.
Mide cuánto la iniciativa amplía o reduce el papel del Estado en la economía. El polo izquierdo abarca derechos sociales universales, redistribución, regulación de precios o salarios y propiedad pública de sectores estratégicos. El polo derecho abarca desregulación, reducción de cargas fiscales, apertura comercial y protección de la propiedad privada.
Mide la postura sobre derechos individuales, identidad y organización familiar. El polo izquierdo abarca expansión de derechos de género, diversidad sexual, derechos reproductivos, laicidad y multiculturalismo. El polo derecho abarca preservación de la familia tradicional, valores religiosos en políticas públicas, restricciones a derechos reproductivos y política migratoria restrictiva.
Mide cómo se distribuye el poder dentro del aparato estatal. El polo izquierdo abarca centralización federal, fortalecimiento del Ejecutivo, ampliación de facultades de organismos federales y nacionalización de funciones. El polo derecho abarca federalismo, autonomía estatal y municipal, contrapesos institucionales y devolución de competencias a órdenes de gobierno locales.
Mide la postura sobre seguridad pública y procuración de justicia. El polo izquierdo abarca enfoque garantista, prevención social del delito, control civil de fuerzas armadas y derechos de víctimas y personas detenidas. El polo derecho abarca aumento de penas, ampliación del catálogo de delitos graves, militarización de la seguridad pública y prisión preventiva oficiosa.
Los miembros del gabinete (23 secretarías activas) aún no tienen clasificación Overton confiable: 0 de 23 cuentan con las ≥4 utterances clasificadas que requiere una posición publicable. La causa es escasez de corpus, no del clasificador — los secretarios casi nunca intervienen en mañaneras (sólo Sheinbaum lleva el podio diariamente) y el corpus de quotes en prensa actualmente sólo cubre referencias a la presidenta.
El plan de cobertura para el gabinete se apoya en extraer declaraciones de prensa nacional, rutearlas por cartera (seguridad para SEGOB y SSPC, economía para SHCP y SE, etc.) y calibrar los ejes resultantes contra la muestra etiquetada a mano. Mientras eso no esté en producción, el perfil de cada secretaría muestra "Cobertura pendiente" en lugar de inventar un número. Preferimos omitir la señal a fabricarla.
Tras evaluar los cuatro ejes, ubicamos la iniciativa en una de siete bandas. La banda es una etiqueta resumen: una iniciativa puede ser de "izquierda" porque empuja con fuerza el eje económico aunque no toque el social, o porque empuja varios ejes con menor intensidad. La banda nunca depende del partido autor.
Cada categoría se nutre de tres capas que se complementan: el texto crudo, un léxico curado y un clasificador estadístico.
Procesamos exposición de motivos, decreto y transitorios — no sólo el título. Las iniciativas mexicanas suelen anunciar su tesis política en la exposición y materializarla en el articulado; ambas piezas son insumo del clasificador.
Mantenemos un catálogo curado de fórmulas legislativas con su correspondencia a categorías del proyecto MARPOR (referente internacional para análisis de manifiestos políticos). Cada entrada documenta el polo del eje, la intensidad y la fuente.
Sobre el léxico se aplica un modelo entrenado con miles de iniciativas previamente etiquetadas. El modelo capta paráfrasis y construcciones que el léxico literal pasa por alto, lo que amplía la cobertura sin sacrificar la rigurosidad de las reglas curadas.
La banda y los ejes resumen el contenido de la propuesta, no la probabilidad de que se apruebe ni la calidad técnica del proyecto. Una iniciativa puede ser etiquetada como derecha extrema y aún así reflejar una posición legítima dentro del debate legislativo. Tampoco predice cómo votará el partido autor.
Iniciativas con texto muy breve o de armonización mecánica suelen quedar sin señal sustantiva — y por tanto sin banda. Algunas categorías de MARPOR están presentes en el debate internacional pero rara vez en el lenguaje legislativo mexicano; por eso se documenta también qué reglas no han disparado en el corpus actual.
Para cada legislador, esta métrica indica con qué frecuencia emitió un voto en las votaciones nominales registradas — favor, contra, abstención o quórum. Un registro marcado como "ausente" cuenta como no participación.
Refleja participación en votaciones nominales, no asistencia física a la sesión. Un legislador puede estar presente pero no aparecer en una votación específica, o viceversa.
El módulo del panel de inicio se calcula con el pase de lista oficial de la Cámara de Diputados — los listados de asistencia por sesión que publica su Dirección General de Apoyo Parlamentario — y no con el tablero de votación:
Listados de asistencia por sesión y grupo parlamentario del Sistema de Información del Trabajo Legislativo (SITL) de la Cámara de Diputados. Cada listado trae su propio resumen oficial de conteos por tipo de asistencia; la ingesta valida cada página contra ese resumen y conserva el texto original de cada registro. La métrica de participación en votaciones descrita arriba sigue calculándose del tablero de votación: son registros distintos y pueden divergir.
El lenguaje de la Gaceta Parlamentaria es preciso pero opaco: un título oficial puede decir «proyecto de decreto que reforma los artículos 17 y 18 de la Ley Orgánica del Congreso General». Para cada iniciativa generamos un título legible y una descripción en lenguaje claro — qué cambia y a quién afecta — a partir del texto legislativo completo.
La generación corre con un modelo de clasificación automática sobre el texto oficial; el modelo no inventa hechos, sólo reescribe lo que la iniciativa propone. El título oficial de la Gaceta se conserva siempre, verbatim, bajo el título legible, para que cualquiera pueda contrastar la versión clara contra la fuente.
No todo lo que pasa por el Congreso de la Unión es lo mismo. Cada tarjeta lleva una etiqueta que indica qué tipo de asunto es:
En la ficha de cada iniciativa mostramos los argumentos a favor, en contra y de contexto que rodean la propuesta. Provienen de dos fuentes: la exposición de motivos de la propia iniciativa y la prensa nacional donde se cita a quienes la respaldan o la objetan.
Sólo publicamos argumentos con cita literal verificada contra su fuente: cada fragmento se compara carácter por carácter con el documento o el artículo de origen antes de mostrarse. Si una cita no se puede verificar, no aparece. Cada argumento de prensa enlaza al artículo original y nombra a quien lo emitió.
El espectro por partido en /diputados ubica a cada bancada en una línea izquierda–derecha a partir de cómo votó en el pleno, no de lo que declara. Para cada votación nominal registrada comparamos el sentido del voto de cada grupo parlamentario: los partidos que votan juntos con frecuencia quedan cerca; los que se oponen de forma sistemática, lejos. El eje se orienta con las coaliciones conocidas (la izquierda a la izquierda) pero su forma la determinan los votos.
Es una medida de comportamiento de voto, no una etiqueta ideológica doctrinal. Un partido puede votar con el bloque por disciplina de coalición más que por convicción. La cifra de votos nominales en que se basa el cálculo aparece bajo el propio gráfico; entre periodos con pocas votaciones el espectro es menos estable.
La posición Overton de un actor —la presidenta, un secretario— resume dónde caen sus declaraciones públicas sobre los mismos cuatro ejes que usamos para las iniciativas. A diferencia de la clasificación de iniciativas (que lee el texto legislativo), aquí el insumo son utterances: intervenciones en la conferencia matutina y citas en prensa con atribución verificada.
El clasificador es deliberadamente polarizante: una declaración doctrinalmente firme se lee cerca de ±0.95. Por eso un puntaje en [-0.5, +0.5] debe leerse como "posición mixta o sin señal fuerte", no como un punto preciso en el centro.
Una cartera necesita al menos 4 utterances clasificadas para publicar una posición; por debajo de ese umbral mostramos "cobertura pendiente" en lugar de inventar un número (ver §02b para el estado del gabinete federal).
La popularidad presidencial proviene de encuestas publicadas por casas demoscópicas, no de un cálculo propio. Mostramos cada serie con su casa encuestadora, fecha de campo, tamaño de muestra y la pregunta tal como la publicó la encuestadora.
Nunca mezclamos casas distintas en un solo número: cada una tiene su propia metodología y combinarlas fabricaría una precisión falsa. Al momento de esta versión la serie en vivo es Mitofsky; cuando se incorporen Buendía-Mendoza, GEA-ISA, Reforma y Enkoll, el panel pasará a un agregado ponderado con banda de margen de error, claramente identificado como tal.
El tono de la prensa clasifica cada mención de un actor en uno de tres buckets —positivo, informativo o negativo— con confianza ≥ 0.75. El bucket informativo es el equivalente en la prensa mexicana de "neutral" (cobertura factual), no exactamente un sinónimo. La ventana por defecto es de 90 días.
Es una lectura del tono editorial, no una medición de aprobación ni de opinión pública. El clasificador se audita periódicamente contra una muestra etiquetada a mano (ver el termómetro del día para la cifra de precisión vigente).
El termómetro del día expresa, en una escala de −1 a +1, qué tan positivo o negativo fue el tono de las menciones de los actores políticos en la prensa publicada hoy. No mide popularidad ni opinión pública: mide cómo la prensa habló del conjunto de actores políticos durante el día.
Cómo se calcula. Para cada mención clasificada en el día con confidence ≥ 0.70, asignamos un valor de tono (positivo = +1, informativo = 0, negativo = −1) y lo ponderamos por dos factores: la prominencia del medio (rango editorial fijo, donde un medio de amplio alcance pesa más que uno regional) y un descuento por sesgo del medio igual a (1 − fracción de menciones no-neutrales del medio en los últimos 365 días). Un medio que casi siempre emite tono no-neutral termina pesando casi cero en el agregado. La cifra final es el promedio ponderado de los valores de tono.
El termómetro solo se publica cuando hay al menos 50 menciones clasificadas en el día; por debajo de ese umbral mostramos un aviso en lugar de una cifra estadísticamente débil. El clasificador de tono se mide contra una muestra de 50 menciones etiquetadas a mano: la última auditoría reportó 93.88 % de coincidencia con la etiqueta humana, por encima del piso operativo del 70 %.
Qué no es. No es un pronóstico de elecciones, no es una medición de aprobación presidencial y no sustituye una encuesta. Cualquier interpretación más fuerte que eso excede lo que los datos sostienen.
Monitoreamos un conjunto acotado de medios nacionales (La Jornada, Excélsior, Milenio, El Financiero, El Heraldo de México, Proceso, Jornada Maya y Animal Político al momento de esta versión). Para cada artículo, un emparejador determinístico busca coincidencias de nombre con la lista oficial de propietarios de la LXVI Legislatura de la Cámara de Diputados, bajo cuatro reglas de precisión decreciente: nombre completo, nombre + apellido paterno único, dos apellidos únicos, y apellido paterno + partido mencionado.
Solo mostramos menciones con confianza ≥ 0.70. No se usan modelos de lenguaje para este componente: el vínculo entre el texto del artículo y el legislador siempre puede auditarse palabra por palabra.
En la ficha de cada iniciativa incluimos un bloque que lista los artículos periodísticos que mencionan a sus autores dentro de una ventana de ±14 días alrededor de la fecha en la que la iniciativa fue registrada (preferimos la fecha de presentación en el Sistema de Información Legislativa; si no está disponible, usamos la fecha de publicación en la Gaceta).
Esta sección no afirma que los artículos traten sobre la iniciativa. Lo que podemos probar, y lo que mostramos, es que uno de los autores registrados fue mencionado por la prensa durante la ventana de presentación. El salto de "el autor salió en la prensa" a "esta iniciativa fue cubierta" requiere un emparejador semántico que todavía no tenemos en producción; está en nuestra hoja de ruta. Preferimos publicar la superficie honesta y parcial a inventar la completa.
El vínculo artículo↔legislador reutiliza el mismo emparejador determinístico de las Menciones: confianza ≥ 0.70, fragmento (span) verbatim, sin modelos de lenguaje en esta etapa. Un artículo que menciona a dos coautores aparece en una sola fila, con el span de la coincidencia de mayor confianza.
El etiquetado de temas asigna a cada cita de la conferencia matutina una de las categorías canónicas de política pública (economía, seguridad, salud, educación, entre otras). Lo hace un enriquecimiento con un modelo de clasificación automática que procesa las citas hacia atrás cronológicamente —de las más recientes a las más antiguas— por lo que la cobertura sube con el tiempo y las citas más viejas pueden estar todavía en cola.
El porcentaje que ves en el panel ("N de M citas etiquetadas") refleja ese avance, no un tope. Una cita sin tema confiable se deja sin etiqueta antes que forzarla a una categoría que no le corresponde.
Esta lista muestra las iniciativas que, según nuestro rastreo del proceso legislativo, están posicionadas para una votación en el pleno: ya pasaron el trabajo en comisión (dictamen publicado o aprobación en comisión) o ya fueron declaradas para discusión. Para cada una calculamos una proyección de votación por coalición con nuestro modelo heurístico de base —tasa histórica por coalición × patrocinador, ajustada por tipo de reforma.
Deliberadamente no mostramos fechas de votación. La Cámara de Diputados publica citatorios a sesiones plenarias, pero no publica de antemano qué iniciativas entrarán en cada sesión; inferir la fecha exacta sería una proyección con más ruido que señal. Cuando mejoremos la cobertura del orden del día, la lista incluirá fecha tentativa y se identificará como tal.
Parte de la lectura actual se deriva de la Gaceta Parlamentaria, que contiene una fracción del registro oficial del SITL (Sistema de Información Legislativa). Estamos integrando el SITL como fuente autoritativa para completar el ciclo de vida de cada iniciativa: presentada, aprobada, rechazada, retirada y desechada. Hasta entonces, los indicadores marcados con "Cobertura preliminar" son provisionales y pueden subestimar el total real.
La Gaceta publica iniciativas a través de secciones y anexos que cambian de formato con el tiempo; el SITL mantiene una entrada por iniciativa con su estado actualizado. Mientras nuestro corpus indexado siga por debajo del registro del SITL, anteponemos un aviso de cobertura a los indicadores dependientes (aprobación legislativa, conteo de aprobadas, reformas constitucionales). Las cifras se mostrarán sin caveat cuando la cobertura alcance al menos el 80 % del total reportado por el SITL para la legislatura.
El pleno del Senado tiene 128 escaños por mandato constitucional (artículo 56): 64 por mayoría relativa (2 por entidad), 32 de primera minoría (1 por entidad al segundo lugar) y 32 plurinominales nacionales. Esa es la cifra que mostramos como número grande del hemiciclo en /senado.
La cifra entre paréntesis ("Registro SIL: 146 (+18) respecto al pleno", por ejemplo) refleja el conteo bruto del SIL, que incluye suplentes que han tomado protesta y senadores que pidieron licencia y regresaron. Cuando un titular pide licencia y su suplente entra, ambos quedan listados —por eso el conteo bruto puede superar 128. Recogemos el registro tal cual lo publica el SIL para no fabricar una precisión que el origen no nos da; la distribución por bancada usa todos esos registros.
El feed de iniciativas del Senado depende del campo iniciativas.camara_origen='senado': el pipeline diario ingiere la sección INICIATIVAS del SUMARIO de la Gaceta del Senado y registra cada asunto con su número de expediente. Las votaciones nominales del Senado todavía no se ingestan —la base actual sólo carga roll-calls de la Cámara de Diputados— así que las métricas derivadas de voto no aparecen aún en las tarjetas de senadores; las reemplazamos con métricas estructurales (presidencias de comisión, secretarías, menciones de prensa) o marcamos "n/d".
Las ratificaciones del Senado —embajadores, ministros de la SCJN, magistrados, comisionados de órganos reguladores y secretarías de Estado— son una facultad exclusiva de la cámara alta (artículos 76 y 89 constitucionales). Por ahora no las ingestamos como datos estructurados: aparecen como iniciativas regulares en la Gaceta sin etiqueta de tipo y nuestros enriquecimientos no las clasifican explícitamente.
Plan: un nuevo tipo de asunto (matter_kind='ratificacion') y un scraper específico de la sección dedicada de la Gaceta del Senado.
Los convenios, tratados y protocolos internacionales requieren aprobación del Senado. Hoy llegan a nuestra base como iniciativas regulares sin etiqueta de tipo; se pueden filtrar por palabra clave ("convenio", "tratado", "protocolo") pero esa clasificación es aproximativa y se omite cuando el enriquecimiento no se ha aplicado.
Plan: añadir un subtipo matter_subtype='tratado' al esquema de enriquecimiento para reconocer tratados explícitamente.
Durante el receso un cuerpo de 19 senadores + 18 diputados mantiene la actividad legislativa. Etiquetamos cada convocatoria y acta con tipo_sesion='comision_permanente' cuando el nombre de la comisión coincide con el patrón %permanente%.
En /senado ("Próximas reuniones de comisiones") las reuniones de la Permanente aparecen con un chip ámbar etiquetado PERMANENTE para que sea legible la actividad de receso.
En /partidos seguimos a quien encabeza cada partido nacional con bancada en el Congreso de la Unión, cuántos curules controla en ambas cámaras y qué dice la prensa de cada uno.
Los conteos de curules salen de nuestra tabla de representantes (registro del SIL), separando Cámara de Diputados y Senado; la dirigencia se mantiene a partir de fuentes oficiales de cada partido; la cobertura de prensa reutiliza el emparejador determinístico de menciones (confianza ≥ 0.70, cita verbatim, sin modelos de lenguaje). No inferimos disciplina de voto en esta página —eso vive en el espectro por votos (§09).
Los órganos constitucionales autónomos (Banxico, INE, INEGI, CNDH, COFECE, IFT, entre otros) no dependen del Ejecutivo: sus titulares tienen periodos fijos, encabalgados con los sexenios, y ratificación legislativa. En /organos-autonomos los seguimos uno por uno por dos señales verificables.
Mostramos qué firman en el DOF (entradas del Diario Oficial atribuidas al órgano) y cuánto los cubre la prensa (mismo emparejador de menciones). No calificamos su desempeño ni su independencia: mostramos actividad documentada, no juicios.
La normalización de gestión resuelve quién ocupaba cada cargo en una fecha dada, para que las comparaciones históricas (por ejemplo, la estabilidad del gabinete entre sexenios) sean justas. Cada registro de funcionario lleva una fecha de inicio y, cuando aplica, una de fin (active_until); una consulta por periodo respeta ese corte en lugar de asumir que el titular actual siempre estuvo.
La cobertura hacia atrás depende de la ingesta histórica del DOF: las administraciones más antiguas (p. ej. Fox 2000–2002) quedan gateadas por dof_historical_backfill_dag hasta que esa ventana se complete. Mientras tanto, los periodos sin respaldo documental se marcan como cobertura parcial en lugar de afirmar una continuidad que no observamos.
De cada conferencia matutina extraemos los anuncios de gobierno concretos (una iniciativa que se enviará, un decreto que se publicará, un programa que arranca), siempre anclados a una cita textual de la versión estenográfica: si la frase exacta no aparece en la fuente, el anuncio no se registra. Después rastreamos cada anuncio hacia adelante durante 60 días contra el Diario Oficial de la Federación y las iniciativas presentadas en el Congreso de la Unión.
El emparejamiento es deliberadamente conservador: exigimos coincidencia en el nombre de la ley o en los artículos citados para afirmar que algo llegó al DOF, y un sujeto distintivo compartido para afirmar que entró al Congreso de la Unión. Preferimos dejar un anuncio como pendiente antes que atribuirle un hecho que no le corresponde. Cuando hay coincidencia, el anuncio enlaza a la publicación o iniciativa que lo concretó, y viceversa.
Cada anuncio que promete una norma publicable (una ley, un decreto, una reforma, un reglamento, una norma oficial) lleva uno de tres estados: lo rastreamos (anunciado hace 30 días o menos), se concretó (ya está en el DOF o en el Congreso de la Unión) o sin concretarse en 30 días. Los 30 días son un corte de lectura, no una sentencia: seguimos buscando hasta 60 días después del anuncio, y si la norma llega tarde el estado cambia a concretado.
La regla es determinista (palabras clave sobre el título del anuncio, sin modelos de lenguaje) y conservadora: un anuncio que implica una reforma pero no nombra ningún instrumento no se marca como promesa de norma, y por tanto nunca aparece como «sin concretarse». Un programa o un acuerdo tampoco caduca: nada suyo debía llegar al DOF. En cambio, el rastreo sí corre para todos los anuncios, de modo que cualquier anuncio que se concrete se marca, prometiera norma o no.
Última revisión de esta metodología · LXVI Legislatura · v0.9