Medición y Valoración del Impacto Social

Sesión 3 — Teoría del programa: la arquitectura del cambio

Paola Velásquez · Juan Carlos Muñoz-Mora

Universidad EAFIT · Formación ejecutiva para Comfama

2026-08-27

S3 · La arquitectura del cambio

Jueves 27 de agosto · 15:00–17:00 · Virtual

Ayer construyeron una cadena.
Hoy preguntamos qué sostiene cada flecha.
Hoy cerramos E2

El salto

Puente con S2

En varias cadenas de ayer pasamos de

“hicimos el taller” → “la gente tiene mejores ingresos”

sin nada en el medio.

Ese salto tiene nombre: supuesto no declarado.

¿Qué estaban suponiendo?

La pregunta que quedó abierta ayer:
¿Qué tendría que ser cierto
para que esa flecha funcione?
Hoy esa pregunta se responde por escrito, flecha por flecha.

Los tres temas que cierra esta sesión

# Tema contratado Cómo se trabaja hoy
B1-2 Teoría del programa: la arquitectura del cambio Marco de las tres teorías y los 6 pasos
B1-3 Diferencias entre insumos, actividades, productos, resultados e impactos El test de nivel, aplicado a la cadena propia
B1-6 Conexión entre diseño de programas y medición de impacto Cierre: la ToC es lo que vuelve medible el programa

Tres teorías que no son la misma

Pregunta que responde Nivel
Teoría del programa ¿Cómo está construida esta intervención y por qué así? El programa completo
Teoría de cambio ¿Por qué creemos que estas acciones producen ese cambio? El mecanismo causal
Teoría de la acción ¿Qué hacemos, con quién y cuándo, para activar ese mecanismo? La operación

Funnell & Rogers (2011), Purposeful Program Theory · verificado 2026-08-20

La cadena de resultados es un sistema

Situación
socioeconómica
→
Necesidades
→
Objetivos
→
Programa
Insumos
→
Actividades
→
Productos
→
Resultados
→
Impactos
↩︎ y esto vuelve a alimentar la situación socioeconómica de la que se partió

Van Dooren, Bouckaert & Halligan (2010), Performance Management in the Public Sector

Qué significa cada nivel, en concreto

Situación · ¿cuál es el problema o la necesidad? (ya cerrado en E1)

Insumos · los recursos que se movilizan: fondos, personal, equipos, materiales

Actividades · lo que el programa hace con esos recursos: entregar, enseñar, capacitar, ofrecer

Productos · lo que resulta directamente de la actividad — tangible, verificable

Resultados · cambios de corto plazo en conocimiento, comportamiento o práctica

Impactos · el cambio de más largo plazo — el objetivo del programa, cerrando el ciclo

El test de nivel

Nivel Pregunta que lo identifica Quién cambia
Insumos ¿Qué ponemos? Nadie todavía
Actividades ¿Qué hacemos? Nadie todavía
Productos ¿Qué entregamos? El programa entrega
Resultados ¿Qué cambia en alguien? El sujeto de impacto
Impactos ¿Qué cambia y se sostiene, más allá del programa? El sujeto y su entorno

Los tres errores de nivel más frecuentes

1. El producto disfrazado de resultado

“Formamos a 500 jóvenes” no es un resultado. Es lo que el programa entregó.

2. El impacto puesto de resultado

“Reducimos la pobreza de la comuna” no cabe como resultado de un programa de 18 meses.

3. La actividad puesta de impacto

“Realizamos la feria de empleo” no es ningún nivel de cambio: es la operación.

La consecuencia no es estética. Un producto reportado como resultado convierte una entrega en una promesa que nadie va a poder sostener.

Ejemplos didácticos · no corresponden a datos de ninguna organización

Dónde termina el control y empieza la contribución

Productos · lo que el programa controla

Si no se entregó, es responsabilidad del programa.

Resultados · lo que el programa influye

Impactos · a lo que el programa contribuye

Aquí actúan el contexto, otros actores y las decisiones de las personas.

Por eso la promesa cambia de forma según el nivel: se rinde cuenta de un producto y se argumenta una contribución.

Los 6 pasos para construir la teoría

1. Situación · qué problema, en qué contexto

2. Objetivo · qué cambio se busca

3. Diseño · qué hace el programa

4. Camino causal · si… entonces…

5. Supuestos · qué tiene que ser cierto

6. Indicadores · cómo lo sabríamos

Estructura basada en Funnell & Rogers (2011) · pasos 4 y 5 son el trabajo de hoy

Ejemplo trabajado · el metrocable

Situación

Vulnerabilidad social y alto desempleo en las comunas altas de Medellín, con altas barreras para acceder a los servicios urbanos.

Objetivo

Incrementar el bienestar de los hogares vulnerables de esas comunas.

Diseño — entre dos opciones

Mejorar la infraestructura vial de acceso a los barrios,

o crear un nuevo sistema de transporte por cable que conecte los barrios al sistema masivo.

Se elige el metrocable.

Ejemplo didáctico de dominio público (Medellín) · mismo arquetipo que el Caso A del banco de contingencia

El paso 4: encadenar, no listar

SI  construimos el metrocable y sus nuevas estaciones
ENTONCES  se abren conexiones cortas al sistema masivo
LO CUAL  los jóvenes acceden a mercados laborales formales
COMO RESULTADO  mejora el bienestar de esos hogares vulnerables

Cada conector es una afirmación causal. Si un conector no se puede explicar, ahí falta un eslabón o falta un supuesto.

Ejemplo didáctico · continuación del caso anterior, sin cifras de organización real

Taller 1 · su camino causal

Salas de equipo · 20 minutos

Reescriban su cadena de ayer con los conectores:

si… entonces… lo cual… como resultado

Y antes de terminar, apliquen el test de nivel a cada eslabón:

¿esto es algo que hacemos, o algo que cambia en alguien?

Máximo 5 eslabones

Si la cadena necesita más de cinco,
el programa está mal delimitado
Se recorta el alcance del programa. No se alarga la cadena.

Pausa · 5 minutos

Una flecha sin supuesto es una flecha misteriosa

El diagrama no explica nada por sí solo.
Lo que explica es
lo que hay debajo de la flecha

Un supuesto, en operación

Tres preguntas por cada flecha

1. ¿Por qué creemos que A conduce a B?

2. ¿Qué tendría que ser cierto para que eso funcione?

3. ¿Qué evidencia tenemos hoy de que se cumple?

La tercera pregunta es la que cambia la conversación.

Evidencia: interna y externa

Origen Clase De dónde sale Pregunta de control
Interna Dato propio Registros, seguimiento, línea de base del programa ¿Existe hoy, o lo estamos asumiendo?
Interna Juicio experto y experiencia El equipo, los operadores, los participantes ¿Está escrito, o solo lo sabe una persona?
Externa Informes (literatura gris) Estadística oficial, registros administrativos, informes de otras organizaciones ¿Cubre a nuestra población y territorio?
Externa Académica El mismo mecanismo probado y publicado en otro contexto ¿Es transferible a nuestro contexto?

La escalera de la evidencia académica

Meta-análisis y revisión sistemáticaagrega evidencia de todos los estudios existentes
Estudios de intervencióncompara un grupo de tratamiento con uno de control
Estudios longitudinalessigue a la misma cohorte en el tiempo
Estudios de control de casoscompara un caso con un caso control
Estudios de corte transversalretrata una población en un momento
Estudio de casoprofundiza en un caso particular
Opinión de expertosjuicio informado sobre el tema

Los dos escalones de arriba se nombran, no se enseñan. El curso no enseña a diseñar experimentos ni meta-análisis (guardarraíl de S1). Sirven para reconocer si ya existe evidencia de ese tipo en la literatura — no para producirla en el aula.

Pirámide de elaboración propia (Juan Carlos Muñoz-Mora) · adaptada al sistema visual del curso

La IA para acceder a la evidencia, no para inventarla

Para qué sí sirve hoy

Ampliar el panorama: buscar si ya existe evidencia externa — informes de otras organizaciones o literatura académica — sobre el mecanismo que su supuesto necesita.

Es exactamente el uso #3 que la política de IA del curso ya autoriza.

La regla que no cambia

Todo lo que una IA entregue — cita, cifra, estudio — se verifica antes de creerlo o proyectarlo.

Los modelos inventan referencias que suenan reales.

Aplica la política de IA ya vigente del curso — no la reemplaza ni la reescribe

¿Cuánto confiamos en un resultado?

1. Triangulación · ¿lo dice más de una fuente, o de más de una clase de evidencia? Una sola fuente es un dato; dos que coinciden ya es una señal.

2. Mecanismo plausible · ¿hay un supuesto detrás que explique por qué pasó, o solo coincide en el tiempo?

3. Atribución o contribución, dicho en voz alta · ¿el programa fue la única causa, o una entre varias?

Esto no es una prueba estadística — el curso no enseña evaluación de impacto contrafactual (guardarraíl de S1). Es un juicio informado, y se dice como tal: “confiamos porque…”, nunca “está probado que…”.

Y una escala honesta de solidez

Verificado · hay un dato que lo sostiene hoy

Plausible · hay evidencia de otro contexto o una razón teórica sólida

Apuesta · lo sostiene la experiencia, sin dato

Un supuesto en apuesta no es un error del programa.

Es lo primero que hay que poner a medir.

Etiquetar un supuesto como apuesta es un acto de rigor, no una confesión.

Taller 2 · declaren y etiqueten

Salas de equipo · 25 minutos · cierre de E2

1. Un supuesto declarado por cada flecha de su cadena.

2. Para cada supuesto: clase de evidencia y etiqueta — verificado · plausible · apuesta.

3. Y al final, la pregunta del cierre:

¿cuál es el supuesto que, si fuera falso, haría colapsar toda la cadena?

Si un supuesto queda en “apuesta”: antes de darlo por perdido, busquen (con IA o sin ella) si ya hay evidencia externa — informes o literatura académica — que lo sostenga.

E2 se cierra hoy

Debe salir

  • cadena de máximo 5 eslabones, sin saltos de nivel;
  • versión narrada coherente con la cadena;
  • un supuesto por flecha, con clase de evidencia;
  • el supuesto más frágil, identificado y justificado.

Todavía no buscamos

  • indicadores SMART (eso es S6);
  • una prueba de atribución;
  • datos nuevos;
  • un supuesto que quede bien en un informe.

Entregable E2 · RA-2 y RA-3 · una ToC sin supuestos declarados no cumple

Plenaria · el supuesto más frágil

Cada equipo · 90 segundos

Digan su supuesto más frágil en voz alta.

No lo vamos a resolver hoy. Queda escrito y queda abierto.

Por qué esto es medición y no solo diseño

Tema B1-6 · la conexión que cierra el bloque conceptual
Un programa se vuelve medible
cuando su teoría está escrita
Sin cadena no hay qué medir. Sin supuestos no hay qué poner a prueba.
Los indicadores vienen después, y vienen de aquí.

Su cadena, vista con dos preguntas de evaluación

Insumos
→
Actividades
Eficiencia→
Productos
Efectividad→
Resultados

Eficiencia · ¿esos insumos se convierten en productos de forma económica y oportuna?

Efectividad · ¿esos productos logran, o se espera que logren, los resultados esperados?

Adelanto informal, no la definición oficial. Mañana ven las 6 definiciones completas y verbatim — incluida coherencia, la que se añadió en la revisión de 2019 — y las aplican a su propio programa.

Glosa de trabajo sobre OECD/DAC (2019/2021) — el texto oficial verbatim se proyecta completo en S4

Mañana: ¿resiste un estándar internacional?

S4 · Marcos de evaluación: criterios OECD/DAC
Ya vieron 2 de 6.
Mañana, el estándar completo.

Traigan su teoría de cambio de hoy, en el estado en que quedó. Los primeros 25 minutos de mañana son para pulirla.