Lectura
Índice completo

PARTE XXI · Estado, gobierno y vida política

229

Políticas públicas: problemas, instrumentos y evaluación

Intervenir, observar y atribuir cambios

Capítulo 229 · 246 capítulos publicados

En este capítulo

Un gobierno instala cien puntos de atención y anuncia que ha resuelto un problema. Sin embargo, las personas a las que debían servir siguen sin acceder: los horarios no coinciden con sus posibilidades o el servicio ofrecido no responde a su necesidad. La entrega de una actividad no demuestra la obtención de un resultado, y la mejora de un resultado no demuestra todavía que la actividad la haya causado.

Las políticas públicas conectan problemas reconocidos, decisiones colectivas e intervenciones. Su evaluación necesita reconstruir esa conexión sin confundir objetivos políticos con hallazgos empíricos. El capítulo 7 explicó la comparación causal; éste pregunta cómo se aplica a decisiones que distribuyen recursos, derechos y riesgos entre personas con intereses diferentes.

229.1. Definición de problemas y formación de agendas#

Un problema público no es simplemente cualquier situación indeseable. Se convierte en objeto de política cuando actores lo definen como asunto que requiere respuesta colectiva y consigue atención institucional. La definición selecciona qué se cuenta, a quién se considera afectado y qué causas se investigan. Esas decisiones modifican las alternativas disponibles.

Por ejemplo, describir dificultades de acceso como falta de información orienta hacia campañas; describirlas como ausencia de transporte orienta hacia infraestructura o movilidad; describirlas como discriminación exige examinar reglas y trato. Las hipótesis pueden coexistir. Elegir una definición antes de observar el recorrido de los afectados puede producir una solución correcta para otro problema.

La agenda reúne asuntos a los que se presta atención. No coincide con la distribución completa de necesidades. Algunos problemas tienen organizaciones capaces de hacerlos visibles; otros afectan a personas dispersas o con escasa posibilidad de intervenir. Una crisis puede concentrar atención sobre un daño reciente mientras problemas persistentes continúan fuera del debate.

El Informe sobre el desarrollo mundial de 2017 examina cómo exclusión, captura y asimetrías de poder condicionan selección y aplicación de políticas. Ese marco permite investigar quién participa en la definición del problema. No convierte cualquier desacuerdo sobre prioridades en evidencia de captura. (Banco Mundial)

Ejemplo construido. Una ciudad quiere reducir lesiones en desplazamientos. Si mide sólo congestión, puede mejorar velocidad y empeorar seguridad. El objetivo de fluidez y el de reducción de daño no son equivalentes. Antes de elegir instrumentos hacen falta datos sobre exposición, lugares, tipos de lesión y población afectada, además de una decisión pública sobre prioridades.

La definición de un problema incluye una población y una referencia. Un aumento de espera puede ser grave para atención urgente y menos relevante para una tarea sin plazo inmediato. Una medida de pobreza depende del criterio utilizado y de aquello que pretende describir. La decisión política necesita expresar qué situación se considera inaceptable y por qué. Esa referencia puede apoyarse en derechos, objetivos acordados o comparación con alternativas, y contiene una valoración que debe permanecer visible.

El diagnóstico debe reconstruir el recorrido que produce el daño. Si una población no obtiene un servicio, puede haber falta de oferta, coste de acceso, información insuficiente o trato excluyente. Cada hipótesis orienta una intervención distinta. La investigación compara casos y busca observaciones que permitan discriminar causas. Elegir el instrumento antes del diagnóstico puede conducir a medir éxito en la actividad elegida y perder la necesidad original. La cadena empieza por el problema y sus mecanismos.

La agenda pública tiene varias etapas. Un asunto puede recibir atención en medios, llegar a una comisión y no obtener decisión; puede aprobarse y quedar sin financiación. La presencia en debate y la incorporación efectiva a un programa son resultados diferentes. Para estudiar influencia se identifican actores, momentos y decisiones. Este recorrido permite observar cómo algunas demandas avanzan y otras se detienen, sin atribuir toda ausencia a falta de importancia ni toda prioridad a un cálculo técnico.

Ejemplo construido. Una autoridad define abandono de formación como falta de motivación y ofrece mensajes de estímulo. Entrevistas y registros muestran que parte de los estudiantes trabaja en horarios incompatibles y otros no pueden pagar transporte. El hallazgo modifica hipótesis y alternativas: horarios, apoyo de movilidad o cambios de organización pueden responder a esas condiciones. La intervención inicial puede ayudar a ciertos participantes, pero la evaluación necesita saber a quién y por qué, además de contar mensajes difundidos.

229.2. Alternativas, instrumentos y restricciones#

Un objetivo expresa el cambio deseado. Un instrumento es el medio elegido: regulación, provisión directa, impuestos, subsidios, información o acuerdos, entre otros. Un instrumento no contiene un objetivo único. La misma subvención puede buscar acceso, empleo o transformación tecnológica, con indicadores y conflictos diferentes.

Elegir alternativas exige describir mecanismo, población destinataria y restricciones. Una campaña informativa presupone que falta conocimiento y que, una vez adquirido, las personas pueden actuar. Si la restricción central es económica o física, informar puede ser insuficiente. Una prohibición presupone capacidad de verificar y hacer cumplir reglas. Su aprobación no crea automáticamente esa capacidad.

Los instrumentos pueden complementarse. Un estándar requiere información y supervisión; una ayuda puede requerir acompañamiento para que los destinatarios logren utilizarla. También pueden contradecirse: un incentivo premia una conducta mientras otra regla la dificulta. Evaluar cada medida por separado puede perder la relación que determina su efecto.

Ejemplo construido. Se desea ampliar el acceso a una formación. Un subsidio reduce el precio, pero quienes cuidan a dependientes no pueden asistir. Añadir horarios flexibles puede responder a esa restricción; aumentar sólo la cuantía quizá no. La explicación no asume que todas las personas afronten el mismo obstáculo y permite comparar alternativas según necesidades identificadas.

Las restricciones jurídicas y presupuestarias delimitan lo posible, pero algunas pueden modificarse mediante decisiones posteriores. Conviene distinguir un límite material, una obligación vigente y una prioridad negociable. Presentar toda restricción como inevitable oculta decisiones políticas; tratar cualquier límite como voluntad insuficiente ignora recursos y competencias reales.

La selección de instrumentos requiere una comparación con la situación sin cambio. Mantener una política tiene costes y consecuencias; reformarla añade otras. Presentar la intervención como único curso que necesita justificación oculta los efectos de conservar el estado actual. La evaluación compara trayectorias plausibles bajo supuestos explícitos. Esa perspectiva permite estudiar urgencia y riesgo de transición sin atribuir a cualquier cambio un resultado favorable por intención.

La regulación define obligaciones y necesita capacidad de cumplimiento. Una norma puede cambiar incentivos si las personas conocen la regla y esperan una respuesta ante infracciones. Su aplicación requiere información y competencias. Una obligación técnicamente correcta que nadie puede verificar puede producir cumplimiento desigual. El diagnóstico compara medios disponibles y condiciones de los regulados. También pregunta si la respuesta prevista es proporcional y si existen procedimientos para aclarar o impugnar decisiones.

Los incentivos económicos modifican precios o recursos y dependen de posibilidades de respuesta. Un subsidio puede reducir coste sin resolver falta de oferta; un impuesto puede cambiar conducta y trasladar cargas a personas con pocas alternativas. La incidencia requiere examinar cómo se ajustan participantes y mercados. El instrumento afecta relaciones, por lo que su efecto no está contenido únicamente en la cantidad anunciada. La comparación necesita seguir quién recibe, quién paga y qué opciones cambian.

La provisión directa implica organizar personal, instalaciones y continuidad. Puede garantizar acceso donde no existe otra oferta y afrontar problemas de capacidad. La contratación externa permite utilizar proveedores y requiere especificación, supervisión y respuesta a incumplimiento. En ambos casos hay decisiones sobre calidad y responsabilidad. Comparar exige identificar qué información posee la autoridad, qué puede observar y quién soporta un fallo. El nombre del proveedor no resuelve esas condiciones por sí solo.

Los instrumentos de información funcionan cuando conocer algo permite actuar. Un mensaje sobre salud puede ser comprendido y no producir cambio si faltan recursos o tiempo. Su evaluación separa recepción, comprensión y conducta. Si una campaña cambia conocimiento, alcanzó una etapa del mecanismo; el objetivo final puede requerir apoyos adicionales. Esta distinción permite reconocer resultados parciales y corregir el diseño sin tratar cualquier efecto incompleto como fracaso total.

229.3. Presupuestos, implementación y coordinación#

El presupuesto autoriza y asigna recursos; la implementación convierte esa decisión en actividad. Entre ambas puede haber contratación, distribución territorial, selección de destinatarios y coordinación. Si una etapa falla, el resultado previsto no llega aunque el instrumento sea plausible en abstracto.

La cadena debe distinguir insumos, actividades, productos, resultados e impacto. Insumos son recursos utilizados; actividades, actuaciones realizadas; productos, entregas directas; resultados, cambios observados relevantes para el objetivo; impacto, cambios atribuibles a la intervención frente a lo que habría ocurrido sin ella. La terminología varía entre sistemas de evaluación, por lo que debe declararse la convención.

Ejemplo construido. Un programa usa presupuesto y personal para ofrecer formación. Las sesiones impartidas y personas atendidas son productos. El aumento observado de competencias es un resultado. La parte de ese aumento causada por el programa es impacto. Que se hayan impartido todas las sesiones no demuestra aprendizaje; que haya aprendizaje no identifica cuánto habría ocurrido por otras vías.

Figura 229.1 — El impacto requiere la comparación que falta

Problema y objetivo orientan instrumento e implementación; producto y resultado se distinguen, y una comparación permite estudiar impacto.

La secuencia expresa una teoría del cambio. El resultado observado se compara con un contrafactual justificado para investigar atribución.

La teoría del cambio hace explícita la secuencia esperada y sus supuestos. No prueba que funcione: ayuda a decidir qué observar. Si se supone que la formación mejora empleo mediante competencias útiles, conviene comprobar tanto aprendizaje como demanda de esas competencias. Un efecto ausente puede resultar de mala ejecución, de un mecanismo equivocado o de condiciones externas.

La implementación requiere responsabilidades que atraviesan organizaciones. Un ministerio puede financiar y un municipio prestar el servicio. Si nadie se responsabiliza de resolver discrepancias entre registros, los destinatarios soportan el conflicto. Diseñar coordinación exige información, plazos y autoridad para corregir, además de acuerdos formales.

El presupuesto distribuye recursos en un periodo y debe relacionarse con un calendario de implementación. Contratar personal, adquirir insumos y preparar instalaciones pueden necesitar secuencias diferentes. Un desembolso tardío modifica capacidad aunque el total anual se conserve. La evaluación sigue disponibilidad y uso, además de autorización. Esa información permite localizar por qué una actividad no comenzó o por qué se ejecutó al final con menor calidad.

La implementación puede modificar el instrumento. Una regla amplia se interpreta en oficinas, proveedores y territorios. Cada participante responde a conocimientos, recursos e incentivos. El diseño necesita identificar dónde existe discrecionalidad y cómo se registra. Una adaptación puede mejorar ajuste a necesidades; otra puede excluir sin justificación. Observar ambas posibilidades exige comparar razones y actuaciones. El objetivo de evaluación es reconstruir cómo la decisión llegó a la población y dónde cambió su contenido.

Ejemplo construido. Un apoyo de formación ofrece el mismo importe, pero una oficina informa activamente y otra espera que las personas conozcan la convocatoria. La cobertura puede diferir por proceso de acceso y no por cuantía. Si la evaluación agrega todas las oficinas, el efecto medio puede ocultar la condición organizativa que permitió utilizar el apoyo. Comparar recorridos y perfiles ayuda a distinguir selección de participantes y calidad de implementación.

La teoría del cambio necesita señalar qué observación cuestionaría una etapa. Si se espera que una formación aumente competencias, se define cómo medirlas. Si se supone que esas competencias mejorarán empleo, se observa demanda y uso. Si el producto se entregó y el resultado no cambió, la revisión busca qué relación falló. Explicitar esos supuestos convierte el diseño en una propuesta examinable y ayuda a escoger datos antes de conocer el desenlace.

Los programas pueden influirse mutuamente. Un apoyo de transporte facilita uso de educación; una regla laboral modifica tiempo disponible; una intervención sanitaria cambia capacidad de asistencia. La evaluación debe identificar exposición a otras actuaciones cuando podrían explicar resultados. La unidad «programa» organiza administración, pero la vida de una persona incluye varios servicios. La interpretación causal necesita relacionar esa experiencia con la comparación utilizada y reconocer efectos de contexto.

229.4. Evaluación de procesos y resultados#

La evaluación de procesos estudia qué se hizo, cómo y con qué obstáculos. La de resultados examina cambios observados. La de impacto intenta atribuir cambios a la intervención. La de relación entre costes y beneficios añade recursos y valoraciones. Estas preguntas se complementan; responder una no resuelve todas.

El Magenta Book del gobierno británico distingue tipos y métodos de evaluación y recomienda planificarla desde el diseño. Su versión HTML actualizada en mayo de 2026 permite consultar ese marco. Aquí se utiliza la distinción entre preguntas de evaluación, sin transferir automáticamente sus reglas administrativas a otras jurisdicciones. (guía)

Ejemplo construido. En un grupo atendido, el empleo pasa del 40 % al 60 %. Ese incremento de veinte puntos no identifica impacto. Si un grupo comparable no atendido pasa del 40 % al 55 %, una comparación de diferencias produce cinco puntos. Interpretarlos causalmente requiere supuestos: grupos comparables en tendencias pertinentes, ausencia de otros cambios diferenciales y datos consistentes. El cálculo no demuestra esos supuestos.

La asignación aleatoria puede ayudar a crear grupos comparables en expectativa cuando resulta ética y viable. No elimina problemas de abandono, cumplimiento parcial o contaminación entre grupos. Las evaluaciones observacionales requieren justificar por qué la comparación aproxima lo que habría ocurrido sin intervenir. Ningún método permite evitar explicar sus supuestos.

La evidencia cualitativa puede revelar mecanismos, experiencias y barreras que los agregados omiten. Entrevistar a participantes seleccionados no estima automáticamente una proporción poblacional, pero puede mostrar que una regla produce dificultades y orientar comprobaciones. Cuantificación y reconstrucción de procesos responden a preguntas distintas, sin una jerarquía automática de utilidad.

Un resultado nulo tampoco demuestra siempre que el programa carezca de efecto. Puede haber poca precisión, implementación incompleta o efectos opuestos entre grupos. Conviene separar ausencia de evidencia suficiente y evidencia de ausencia dentro de un rango. Esa distinción informa qué se sabe y qué investigación podría cambiar la conclusión.

La investigación de María Caridad Araujo y Karen Macours publicada por el Banco Interamericano de Desarrollo en 2021 utiliza el diseño experimental de la puesta en marcha de Progresa, en México entre 1997 y 2000, y un seguimiento veinte años después. Examina exposición en etapas infantiles diferentes. El caso ilustra por qué periodo de intervención, edad y horizonte de seguimiento forman parte de una evaluación. Aquí se utiliza su diseño y alcance; no se trasladan cifras de efecto ni se generaliza a toda transferencia monetaria. (estudio y resumen)

Una comparación experimental debe distinguir asignación y recepción. La asignación ofrece una relación inicial cuya interpretación depende de pérdidas y cumplimiento. Si algunas personas asignadas no utilizan el servicio, el efecto de ofrecerlo y el efecto de recibirlo son preguntas diferentes. Estimar esta segunda relación exige condiciones adicionales. Declarar la pregunta ayuda a evitar que un resultado se interprete como respuesta a otra. El programa real debe explicar tanto acceso como utilización.

El seguimiento plantea selección. Si es más difícil localizar a quienes migraron o afrontaron problemas, los datos disponibles pueden describir una población distinta de la inicial. La investigación necesita documentar pérdidas y examinar qué podrían cambiar. Un periodo largo permite observar persistencia y añade incertidumbre sobre comparabilidad. Las estimaciones deben conservar esas condiciones. La duración del seguimiento, por sí sola, no garantiza una conclusión más fuerte que la de un estudio breve.

La precisión también importa. Un intervalo amplio puede ser compatible con efectos relevantes positivos y negativos; en ese caso el resultado permanece poco determinado. La evaluación debe indicar qué magnitudes puede descartar bajo sus supuestos. Distinguir precisión y tamaño estimado permite interpretar un efecto pequeño con incertidumbre grande. La decisión puede necesitar nueva información, revisión del instrumento o una consideración explícita del riesgo de actuar bajo esa incertidumbre.

La validez para otros contextos exige estudiar condiciones. Un mecanismo puede depender de oferta suficiente, capacidad de atención o determinadas restricciones de los destinatarios. Trasladarlo requiere verificar si esas condiciones existen y qué debe adaptarse. La evidencia de una intervención concreta permite formular expectativas condicionadas. La ampliación a mayor escala puede cambiar disponibilidad, coordinación y precios, por lo que también necesita evaluación de las relaciones que se transforman.

229.5. Consecuencias distributivas y efectos no previstos#

Una intervención puede producir una mejora media y distribuir cargas de manera desigual. Los beneficiarios, quienes financian y quienes soportan riesgos no necesariamente coinciden. La evaluación debe observar quién gana, quién pierde y en qué periodo, además de cuánto cambia el promedio.

Los efectos no previstos pueden resultar de adaptación. Si una ayuda depende de un umbral rígido, personas e instituciones pueden modificar conductas cerca de ese límite. Si se premia exclusivamente volumen, puede deteriorarse calidad. No es necesario atribuir mala intención para explicar una respuesta a incentivos; sí hace falta evidencia antes de afirmar que ocurrió.

Ejemplo construido. Una subvención a viviendas mejora condiciones de quienes acceden, pero la oferta permanece limitada y suben precios en ciertas zonas. La ayuda puede seguir produciendo beneficios y transferir parte de sus recursos a propietarios. Para estimar el reparto hacen falta datos de oferta, contratos, elegibilidad y evolución territorial. Una intención redistributiva no determina por sí sola incidencia efectiva.

Los efectos temporales también importan. Una intervención puede ser costosa al inicio y ahorrar recursos posteriormente, o producir una mejora breve que no se sostiene. Seleccionar sólo el periodo favorable distorsiona la evaluación. El horizonte debe corresponder al mecanismo y declararse antes de comparar alternativas cuando sea posible.

La protección de derechos no se reduce a una suma de beneficios. Un balance agregado favorable no justifica automáticamente vulnerar garantías. La evaluación económica ofrece información sobre consecuencias bajo convenciones de valoración; el derecho y la deliberación política determinan otras restricciones y prioridades.

La distribución debe estudiarse dentro de cada población y entre ellas. Una mejora media puede proceder de grandes beneficios para quienes acceden fácilmente y resultados nulos para quienes enfrentan barreras. Separar efectos por grupos requiere datos suficientes y una hipótesis razonada, evitando buscar diferencias después de observar resultados hasta encontrar una favorable. La evaluación combina magnitud, incertidumbre y condiciones de acceso. El objetivo es conocer quién recibió el efecto y qué mecanismo lo explica.

Ejemplo construido. Un servicio reduce espera de cuarenta a veinte días en promedio. Quienes utilizan atención digital pasan de treinta a diez, mientras quienes necesitan asistencia presencial permanecen en cincuenta. La mejora general convive con una brecha de acceso. Decidir cómo responder exige valorar necesidades y costes y comprobar si los casos son comparables. La cifra media informa sobre cambio agregado; la distribución orienta una investigación de equidad y capacidad.

La evaluación de costes necesita un horizonte y una perspectiva. Una reforma puede reducir gasto de una oficina y aumentar tiempo o viajes de usuarios. Una inversión puede elevar coste inicial y reducir fallos posteriores. Incluir o excluir esos efectos cambia la comparación. La elección debe justificarse y mostrar consecuencias que no pueden resumirse fácilmente en dinero. El balance económico aporta una descripción bajo convenciones explícitas y se integra con derechos y prioridades.

229.6. Diferenciar evidencia, objetivos y elección política#

La evidencia puede mostrar que un instrumento produce un efecto con ciertos costes y condiciones. No decide por sí sola cuánto vale ese efecto frente a otro ni cómo deben distribuirse las cargas. Para pasar de un hallazgo a una recomendación hacen falta objetivos, valores y restricciones explícitos.

Ejemplo construido. Dos programas cuestan lo mismo. Uno mejora un indicador en muchas personas de forma pequeña; el otro mejora mucho la situación de una población menos numerosa y más desfavorecida. Elegir requiere decidir cómo ponderar alcance, intensidad y desventaja. Mejor información puede aclarar las consecuencias, pero no contiene esa ponderación moral.

«Basado en evidencia» no debe convertirse en una fórmula que oculta decisión política. Tampoco el desacuerdo sobre valores permite ignorar resultados. Se puede discrepar sobre prioridades y aceptar que una intervención no produce el efecto que se le atribuye. La neutralidad analítica exige distinguir ambos desacuerdos.

Una política comprensible identifica el problema, la alternativa, el mecanismo y las condiciones de revisión. Publicar sólo una cifra final impide saber si cambió la ejecución o la hipótesis. La rendición de cuentas mejora cuando se puede reconstruir por qué se eligió, qué ocurrió y qué información justificaría corregir. La disputa sobre agendas y evidencias conecta con grupos, medios y opinión pública, examinados a continuación.

Una recomendación contiene al menos una afirmación sobre efectos y un criterio de elección. Si se afirma que una política es preferible, debe explicarse para qué objetivo, frente a qué alternativa y bajo qué restricciones. Dos personas pueden aceptar la misma evidencia y discrepar sobre prioridad de grupos o reparto de riesgos. Esa diferencia pertenece a valoración. Otras pueden compartir el objetivo y discrepar sobre eficacia del instrumento; ahí se necesitan mejores observaciones o modelos.

La revisión pública debe hacer visible qué cambiaría la decisión. Puede ser una pérdida de eficacia, un daño no previsto, una nueva alternativa o modificación de recursos. Expresar esas condiciones permite evaluar si la autoridad aprende o protege una elección previa frente a toda evidencia. La responsabilidad política incluye justificar objetivos y responder a resultados. Una política bien explicada ofrece al lector la cadena que conecta necesidad, actuación, comparación y criterio de revisión.

Preguntas de transferencia#

Cien entregas#

Ejemplo construido. Un programa entrega todos los equipos previstos y afirma haber mejorado aprendizaje.

Mostrar respuesta razonada

La entrega es un producto; el aprendizaje requiere medición adicional y el impacto una comparación causal. Límite. Los equipos pueden ser un medio necesario. Datos necesarios. Uso, competencias, condiciones previas y resultados comparables sin intervención.

Antes y después#

Ejemplo construido. Un indicador mejora después de una política y también en territorios no atendidos.

Mostrar respuesta razonada

La mejora observada puede incluir cambios externos. Límite. Una comparación territorial tampoco garantiza equivalencia causal. Datos necesarios. Tendencias previas, composición, exposición y otras intervenciones.

Promedio favorable#

Ejemplo construido. Una evaluación encuentra mejora media, pero pérdidas concentradas en un grupo.

Mostrar respuesta razonada

Eficacia agregada y distribución son preguntas distintas que deben informarse juntas. Límite. La compensación o revisión exige decisiones adicionales. Datos necesarios. Magnitud, duración, composición y derechos de las personas afectadas.

La evidencia elige#

Ejemplo construido. Una autoridad declara que un cálculo técnico obliga a priorizar crecimiento sobre igualdad.

Mostrar respuesta razonada

El cálculo puede describir una relación entre resultados, pero la prioridad incorpora una valoración. Límite. Restricciones jurídicas o materiales pueden excluir alternativas. Datos necesarios. Objetivos, supuestos, consecuencias distributivas y restricciones explícitas.

Fuentes y lecturas del capítulo#

Banco Mundial. World Development Report 2017: Governance and the Law. Aporta un marco sobre compromiso, cooperación, coordinación y asimetrías en decisiones públicas. (documento)

Gobierno del Reino Unido. Magenta Book: Central Government guidance on evaluation; actualización de 15 de mayo de 2026. Distingue preguntas, tipos y métodos de evaluación; se utiliza como marco metodológico, no como norma universal. (documento)

María Caridad Araujo y Karen Macours / Banco Interamericano de Desarrollo. Education, Income and Mobility: Experimental Impacts of Childhood Exposure to Progresa after 20 Years (2021). Se consulta ficha y resumen para diseño 1997–2000, cohortes y seguimiento; no se atribuye lectura del artículo íntegro ni se trasladan estimaciones. (documento)

Bibliografía de la parte XXI · Bibliografía general

Última revisión editorial
Cierre de contenidos