Te respondió bien y aun así perdiste el día
Le pides algo a la IA. Te lo entrega. Está bien hecho, se ve correcto, no tiene errores. Y no te sirve, porque lo que tú querías nunca llegó a salir de tu cabeza.
La IA optimiza lo que le pediste, no lo que querías.
Cuando encima el trabajo lo reparten varios agentes, aparece el segundo agujero, y es peor: cada uno termina y reporta «completado». Eso es su opinión, no una prueba. Nadie lo contrastó contra nada, porque no había nada escrito contra lo que contrastarlo.
Este plugin —cuatro skills y dos agentes— cierra esos dos huecos. Es el mismo método de El Plano, pero llevado al día a día de quien ya construye con agentes: en vez de una hoja que rellenas, son instrucciones que la IA sigue sola.
Si te quedas con una sola frase, esta
Quien construye no verifica. Y se verifica contra los criterios escritos, nunca contra el «completado» que el agente se puso a sí mismo.
Todo lo demás —el reparto en bloques, las verificaciones adversariales, el contrato de la ronda— es aparato que puedes recortar cuando el trabajo es pequeño. Esa frase, no.
Un plugin de Claude Code: cuatro skills y dos agentes
specConvierte tu idea en un SPEC.md con criterios que se contestan sí o no. El objetivo real, qué queda fuera, y qué necesita tu permiso.
Cuándo: Al empezar cualquier construcción de varios pasos
orquestadorReparte el trabajo en bloques con dueño exclusivo de archivos, lanza los agentes a la vez, verifica según el riesgo y hace un solo commit al final.
Cuándo: Cuando el trabajo se parte en 3 o más frentes, o toca base de datos, dinero o producción
verificar-specIntenta demostrar que NO cumple, criterio por criterio y con la evidencia señalada. Devuelve cumple, no cumple o no verificable.
Cuándo: Antes de integrar, o cuando un agente dice «completado» y nadie lo comprobó
codexTrae al CLI de Codex como segundo par de ojos. Otra familia de modelos: no reconoce tus decisiones y por eso no las lee como correctas.
Cuándo: Al cerrar una ronda, o cuando quieras una opinión que no comparta tus sesgos
Y dos agentes, con las reglas incorporadas:
bloque-constructorConstruye un bloque respetando la propiedad exclusiva de archivos. Lleva dentro los comandos que no puede correr en paralelo, «nunca commitees ni pushees» y «producción es solo lectura».
lente-adversarialNo construye: intenta demostrar que un bloque está roto. Lleva dentro «refutar, no revisar» y reproducir contra el sistema real en vez de razonar sobre el código.
Antes esas reglas eran párrafos que había que copiar en cada encargo. Ahora son parte del agente: se aplican tanto si quien orquesta se acordó de pegarlas como si no.
Se usan juntas, pero spec y verificar-spec funcionan solas si lo único que quieres es dejar de entregar a ciegas.
Cómo se ve una ronda entera
En el móvil se arrastra a los lados: encogido entero no se leería ninguna etiqueta.
- Un bloque, un dueño
Cada bloque es el único que puede tocar sus archivos. Sin eso, verificar un bloque mientras otro escribe debajo es apuntar a un blanco móvil.
- El riesgo decide cuánto se verifica, y cuándo
Lo que puede filtrar un dato, dejar a alguien fuera o equivocar un importe se revisa en cuanto ese bloque cierra, sin esperar a los demás. Así el fallo grave aparece mientras todavía es barato arreglarlo.
- Y aun así hay una parada al final
Porque hay defectos que solo existen entre bloques: una firma que nadie respetó, el mismo hallazgo contado tres veces. Eso solo se ve con todo delante.
Menos de lo que parece
Se instala con dos comandos, dentro de Claude Code:
/plugin marketplace add padremprendedor-create/EL-ORQUESTADOR
/plugin install el-orquestador@el-orquestadorNo hay nada que compilar ni dependencias que instalar aparte: sigue pesando poco.
- Claude Code
En terminal, en app o dentro de tu editor: da igual cuál. Es lo único imprescindible, y funciona en Windows, Mac y Linux.
- El CLI de Codex (opcional)
Solo lo usa una de las cuatro skills, la de la segunda opinión. Sin él las otras tres funcionan igual: te saltas ese paso.
- Presupuesto de tokens
Esto es lo que de verdad limita, no tu máquina. Una ronda grande lanza varios agentes a la vez y consume mucho. El primer paso del método existe justo para decidir si compensa antes de gastarlo.
Si prefieres no usar el gestor de plugins, el README trae también la vía manual —copiar los archivos a mano, con los comandos en bash y en PowerShell— y avisa de la única orden de esa instalación que puede pisar un archivo tuyo.
El número que casi nadie publica
Tres rondas reales, medidas mientras ocurrían —no un benchmark preparado para publicar: el mismo equipo usando el método en sus propios proyectos, con lo que dio cada vez—, para que decidas antes de arrancar si te compensa:
- Rondas medidas
- 3
- Tokens de subagente
- 2,1 M – 3,3 M
- De eso, verificación
- 20 % – 32 %
- Cómputo de los agentes
- 1 h 14 – 4 h 25
- Camino crítico real
- 25 min – 1 h 30
- Código por ronda
- 2 000 – 12 700 líneas
El aparato no es gratis y no siempre compensa. Para un formulario, montar la ronda entera quema tokens sin motivo. Para una migración de base de datos, saltársela quema producción. El método obliga a decir en voz alta por qué eliges la vía corta cuando la eliges.
La primera ronda puso lentes de verificación sobre todo el código por igual: 31,7 % del gasto. La segunda las puso solo sobre el único bloque de riesgo alto —una migración de base de datos— y bajó al 20,1 %, encontrando los tres defectos graves igual, porque estaban todos en el SQL.
Y en las tres se repite la misma distancia: entre lo que computaron los agentes sumado (1 h 14 – 4 h 25) y lo que de verdad tardó el camino crítico de la ronda (25 min – 1 h 30) hay un factor de entre dos y cuatro veces. El cuello de botella no son los agentes, es esperarlos.
Lo que no se recorta aunque tengas prisa
- QUIEN CONSTRUYE NO VERIFICA
Y se verifica contra los criterios escritos, nunca contra el «completado» que el agente se puso a sí mismo. Todo lo demás del método se puede recortar. Esta frase no.
- SOLO UNO COMMITEA
Los agentes escriben archivos y reportan. El commit lo hace uno solo, al final. Git es secuencial: tres agentes subiendo cambios a la vez es un lío de horas.
- UN ARCHIVO, UN DUEÑO
Por ronda. Si dos bloques necesitan tocar el mismo archivo, se produce antes, aparte. Sin esto, verificar un bloque mientras otro escribe debajo es apuntar a un blanco móvil.
- NINGÚN SQL A CIEGAS
Ninguna migración se aplica sin que alguien externo la haya verificado antes. Sin esa verificación no se aplica: se propone.
Ninguna de las cuatro es un candado técnico: son reglas escritas que el agente sigue porque están ahí. El repositorio trae un documento que lista todo lo que un agente puede llegar a hacer siguiendo estas instrucciones, y un fallo silencioso que conviene comprobar a mano antes de confiar en él.
Cuándo esto te sobra
- Trabajo de un solo paso: un texto, un cambio de color, arreglar una errata. Escribir el plano cuesta más que hacerlo.
- Cuando estás explorando y todavía no sabes qué quieres. El método sirve para construir, no para pensar en voz alta.
- Si no usas agentes todavía: empieza por El Plano, que es la misma idea en una hoja y sin terminal.
Está escrito en español, y eso es a propósito
Casi todo lo que se publica sobre construir con agentes está en inglés y asume que eres programador. Este plugin —cuatro skills y dos agentes— sale del uso diario en proyectos reales de esta comunidad, y está escrito para que lo lea alguien que aprendió a construir con IA hace seis meses.
Se puede leer, copiar, cambiar y usar en tu trabajo incluso cobrando por ese trabajo. Es licencia MIT: solo hay que conservar el aviso de autoría.
9 preguntas. Te llevas tu ruta: qué aprender, qué usar y qué ignorar.
¿Tus agentes entregan y no sabes si está bien?
Si ya trabajas con IA y el problema no es que no construya, sino que no sabes qué revisar de lo que te entrega, eso se ordena en una conversación. Agenda una llamada y lo miramos con tu caso delante.
Sin compromiso. No prometemos ingresos ni resultados garantizados.