# Más agentes, menos WIP: la capacidad de revisión es el nuevo límite

> Abrir más agentes que cambios puede revisar el equipo sólo crea una cola más rápida: el WIP debe quedar limitado por integración y aprendizaje.

- Author: Viktor Berthelius (BRTHLS)
- Published: 2026-07-30
- Category: ai operating models
- Tags: coding-agents, dora, wip-limits, review-capacity
- Language: es
- Canonical: https://www.brthls.com/magazine/coding-agents-limite-wip-capacidad-revision-es
- Source: BRTHLS Magazine — https://www.brthls.com

---

## Problema

Los agentes de coding pueden dividir trabajo, modificar repositorios, ejecutar pruebas y devolver artefactos revisables en paralelo. El coste marginal de producir código cae. La capacidad del sistema para decidir qué construir, integrar cambios y verificar valor no crece al mismo ritmo.

Ese desacople crea una ilusión peligrosa: más pull requests parecen más progreso. En realidad, el equipo puede acumular especificaciones ambiguas, revisiones superficiales, decisiones de arquitectura incompatibles y features que nadie necesitaba. La fábrica produce más unidades, pero la línea de validación sigue teniendo el mismo ancho.

Cuando generar código deja de ser escaso, la pregunta operativa ya no es cuántos agentes puede abrir el equipo. Es cuántos cambios puede entender, integrar y observar sin degradar criterio.

## Tesis

La concurrencia agentiva debe quedar limitada por la capacidad humana y técnica de revisión, integración y aprendizaje.

Abrir diez tareas porque existen diez agentes disponibles no aumenta el throughput si el equipo sólo puede evaluar dos cambios con profundidad. Aumenta WIP, tiempo en cola, conflictos y contexto que debe reconstruirse. El límite sano es el número de outcomes que pueden aceptarse —o rechazarse— con evidencia dentro de un SLA explícito.

El KPI central no puede ser agentes activos, líneas, commits ni PRs generados. Debe medir tiempo desde hipótesis hasta outcome validado, incluyendo espera, rework, incidentes y decisiones revertidas.

## Framework

Define un **presupuesto de revisión** antes de lanzar trabajo: cuántos cambios puede el equipo comprender, probar, integrar y observar por ciclo. Después reparte ese presupuesto entre cinco capas:

- **Descubrimiento:** elegir un problema real antes de multiplicar soluciones.
- **Diseño de producto:** convertir intención en comportamiento, estados, excepciones y criterios de aceptación.
- **Diseño de sistema:** definir límites, ownership, contratos y consecuencias de cada cambio.
- **Integración:** revisar artefactos, pruebas y compatibilidad sin reconstruir toda la sesión del agente.
- **Aprendizaje:** observar uso, calidad y negocio para decidir la siguiente iteración.

La capacidad de coding acelera la producción, pero presiona las demás capas. Si una prueba es flaky, una dependencia no está documentada o el entorno difiere de producción, el fallo ya no bloquea a una persona: interrumpe una flota. Si la especificación es mala, el error se replica en paralelo.

La métrica útil es throughput de **outcomes aceptados**, no de cambios propuestos. El WIP máximo debe bajar cuando crecen el tiempo de revisión, los conflictos o el rework, aunque queden agentes libres.

## Por que importa ahora

Cursor describe una «tercera era» donde agentes en la nube trabajan durante más tiempo, en paralelo y con menos dirección síncrona. En su experiencia interna, afirma que más de un tercio de los PR fusionados ya proceden de agentes autónomos. Su propia descripción mueve el rol humano hacia descomponer problemas, aportar herramientas y contexto, revisar artefactos y dar feedback.

Es una señal del proveedor, no una ley universal. La investigación de DORA aporta una base más amplia: su informe de 2025 presenta la IA como amplificador de fortalezas y debilidades organizativas, y sitúa el mayor retorno en el sistema sociotécnico subyacente. El Core Model conecta rendimiento con capacidades como documentación, lotes pequeños, feedback rápido, integración continua, equipos desacoplados y foco en el usuario.

Ambas fuentes convergen en una idea operativa: mejorar el generador no arregla el flujo. Cursor muestra la nueva oferta de concurrencia; DORA recuerda que lotes pequeños, feedback rápido, integración continua y equipos desacoplados determinan si esa oferta se convierte en rendimiento.

La decisión diferencial no es adoptar agentes, sino imponer un límite de WIP por debajo de la capacidad máxima de generación. Dejar agentes ociosos puede ser la opción más productiva cuando la cola de revisión ya supera su SLA.

## Anti-ejemplo

Un equipo abre veinte tareas del backlog y asigna un agente a cada una. En dos horas recibe veinte ramas verdes. Cinco cambian el mismo contrato, cuatro resuelven síntomas de un problema compartido, tres añaden telemetría incompatible y ninguna incluye evidencia de usuario.

El manager celebra el throughput y crea una cola de revisión imposible. La velocidad local del agente ha empeorado el flujo global.

No es un problema de capacidad. Es ausencia de diseño de cartera, límites de WIP y arquitectura de decisión.

## Protocolo (3 pasos)

1. **Mide la capacidad de salida.** Cuenta cuántos cambios puede revisar, integrar y observar el equipo por ciclo, con su espera y rework.
2. **Fija el WIP máximo.** Abre sólo tantas tareas agentivas como outcomes pueda decidir el sistema dentro del SLA de revisión.
3. **Ajusta con evidencia.** Baja el límite si crecen cola, conflictos o defectos; súbelo sólo cuando la capacidad de integración demuestre margen.

| Etapa | Nueva presión | Contrato necesario | Métrica |
| --- | --- | --- | --- |
| discovery | demasiadas soluciones posibles | problema y usuario | hipótesis validadas |
| producto | requisitos ambiguos | estados y aceptación | rework funcional |
| arquitectura | cambios paralelos | límites y ownership | conflictos e incidentes |
| revisión | exceso de output | artefactos y pruebas | tiempo hasta decisión |
| aprendizaje | shipping sin señal | telemetría y umbral | outcome adoptado |

## Relacionado

- [Factory 2.0: el ingeniero ya no escala solo código, escala fabricas de software](/magazine/factory-2-0-ingeniero-no-escala-codigo-escala-fabricas-software-es)
- [GPT-5.3 Codex: el día que la ejecución deja de ser el cuello de botella](/magazine/gpt-5-3-codex-ejecucion-deja-ser-cuello-botella-es)
- [Decisión Quality: el KPI que reemplaza a la velocidad](/magazine/decision-quality-kpi-reemplaza-velocidad-es)

## Fuentes consultadas

- [State of AI-assisted Software Development 2025 - DORA](https://dora.dev/research/2025/dora-report/)
- [DORA Core Model](https://dora.dev/research/)
- [The third era of AI software development - Cursor](https://cursor.com/blog/third-era)

## Próximo paso

Revisa las últimas diez tareas agentivas. Mide cuánto tardaron en generarse y cuánto esperaron para ser entendidas, integradas y validadas. Usa la capacidad de esa segunda parte para fijar el WIP de la próxima semana.

---

_Cite as: Berthelius, V. (2026). "Más agentes, menos WIP: la capacidad de revisión es el nuevo límite". BRTHLS Magazine. https://www.brthls.com/magazine/coding-agents-limite-wip-capacidad-revision-es_
