Problema
Muchos pilotos de IA empiezan con una herramienta y terminan con una demo. El equipo puede mostrar que algo funciona, pero no sabe si mejora una decisión, reduce un coste completo o merece integrarse en la operación.
Tesis
Un buen experimento de IA no pregunta «¿puede hacerlo?». Pregunta «¿qué decisión cambia, con qué evidencia y a qué coste de supervisión?». Catorce días son suficientes para obtener señal si el alcance es estrecho.
Framework
Diseña el test alrededor de cuatro elementos:
- Decisión: el momento concreto que quieres mejorar.
- Línea base: cómo se resuelve hoy, incluido tiempo humano.
- Umbral: qué resultado justificaría continuar.
- Límite: qué daño, error o coste detiene la prueba.
| Fase | Días | Entregable |
|---|---|---|
| Mapear | 1–3 | Decisión, casos y línea base |
| Probar | 4–10 | Registro de resultados y excepciones |
| Decidir | 11–14 | Continuar, corregir o parar |
Por que importa ahora
El AI RMF de NIST organiza la gestión en gobernar, mapear, medir y gestionar. No necesitas implantar un programa corporativo para aplicar la lógica: el experimento debe tener contexto, medida, responsable y respuesta ante el riesgo.
Anti-ejemplo
El equipo compara dos modelos con veinte prompts, elige el que «suena mejor» y lo integra. Nadie registra falsos positivos, minutos de revisión ni decisiones afectadas. La demo gana; la operación hereda la incertidumbre.
Protocolo (3 pasos)
- Escribe una ficha de una página: usuario, decisión, datos permitidos, métrica y condición de parada.
- Prueba casos reales y límites: incluye ejemplos normales, ambiguos y adversos.
- Celebra una revisión de decisión: continuar solo si la mejora supera el coste total y los riesgos observados.
Relacionado
- Qué no automatizar todavía en una startup
- AI Fluency para docentes: enseñar criterio, no solo prompts
Fuentes consultadas
Próximo paso
Convierte el próximo «deberíamos usar IA para…» en una ficha de experimento. Si no cabe en una página, el problema todavía no está suficientemente definido.