DOS SKILLS · CLAUDE CODE

spec-driven

Dos skills para que la IA construya lo que querías y no solo lo que pediste: una escribe el plan antes, con criterios que se contestan sí o no; la otra intenta demostrar después que no se cumplió.

Para ti si: Ya construyes con Claude Code y te ha pasado que el trabajo queda «hecho» y aun así no sirve. Solo necesitas Claude Code: nada más que instalar ni pagar.

ANTES DE EMPEZAR

Esto necesita un solo programa: Claude Code. Es quien lee las skills. No hay nada que pagar aparte ni ninguna otra herramienta que instalar.

Si nunca has abierto Claude Code, empieza por la guía Tu taller, que es justo eso. Vuelve aquí cuando tengas una terminal que te responda.

Lo que pediste y lo que querías

Una IA optimiza lo que le pediste, no lo que querías. Si el objetivo real nunca sale de tu cabeza, el resultado va a ser correcto y aun así inútil: la landing quedó impecable, pero nadie escribe por WhatsApp — y ese era el punto.

Entre «hazme una landing» y «quiero que me escriban» hay un hueco. Ahí es donde se pierde el trabajo: no por errores de código, sino porque nadie escribió qué tenía que pasar cuando estuviera hecho.

Estas dos skills cierran el hueco por los dos lados. Una saca el objetivo a un archivo antes de construir, donde se puede leer y corregir. La otra vuelve a ese archivo después e intenta demostrar que no se cumplió.

El plano antes, la comprobación después

Tres tiempos. El del medio es el que ya conoces: construir con Claude Code. Lo que cambia es lo que hay a los lados.

El ciclo en tres pasos: spec escribe el SPEC.md antes, se construye con Claude Code en medio, y verificar-spec intenta demostrar después que no se cumplió. Si cumple se integra; si no cumple, vuelve a construir con el informe y se verifica otra vez.

En el móvil se arrastra a los lados: encogido entero no se leería ninguna etiqueta.

  1. 1SPEC· Antes

    Te pregunta qué cambia cuando esto funcione

    No qué quieres construir: qué pasa distinto cuando esté. Con eso escribe un SPEC.md con el objetivo, lo que queda fuera y criterios que se contestan sí o no.

  2. 2TU Y CLAUDE CODE· En medio

    Construyen como siempre

    Nada cambia en cómo trabajas. Lo que cambia es que ahora hay un objetivo escrito contra el que medir, en vez de lo que cada uno recuerda haber pedido.

  3. 3VERIFICAR-SPEC· Después

    Intenta demostrar que NO se cumplió

    Criterio por criterio, con evidencia. Devuelve cumple, no cumple o no verificable — y si no cumple, el trabajo vuelve con el informe en vez de integrarse «y ya».

Con las skills instaladas no hay comando que memorizar. Le dices a Claude Code «vamos a construir una app para mi negocio» y arranca la primera; cuando el trabajo esté hecho, «verifica que cumple» y arranca la segunda.

Un criterio que sirve

Todo el método se sostiene en una sola cosa: que los criterios de éxito se puedan responder sí o no, sin discutir. La prueba es esta: ¿podría comprobarlo alguien que no estuvo en la conversación? Si necesita tu contexto para saber si se cumplió, no es un criterio. Es una intención.

  • NO SIRVE

    «La landing quedó bien»

    SIRVE

    «Un desconocido entra y en 10 segundos sabe qué se vende»

  • NO SIRVE

    «El agente corrió correctamente»

    SIRVE

    «Los 6 bloques dejaron archivo con contenido real y la compilación pasa»

  • NO SIRVE

    «Mejoró la conversión»

    SIRVE

    «El formulario envía a la base de datos y llega el WhatsApp de prueba»

  • NO SIRVE

    «El código está limpio»

    SIRVE

    «No hay tipos «any» nuevos y el lint pasa sin avisos»

Y cada criterio lleva al lado con qué se comprueba: un comando, una pantalla que se mira, una persona que lo prueba. Un criterio sin forma de comprobarlo es decoración — y es justo el hueco por donde se cuela un «completado» que nadie contrastó.

Un SPEC real, por dentro

Este es el SPEC con el que se construyó codex-imagenes, la otra skill de este estante. Cuatro recortes para no exponer nombres ni ramas internas; los criterios y las 16 filas de bitácora van enteros, errores propios incluidos, que es la parte que enseña.

OBJETIVO REAL

Hoy pasa que el método se cuenta y no se enseña: la Bóveda promete «skills de Claude Code» y no hay ninguna, así que quien llega tiene que creerse de palabra que aquí se verifica en vez de aceptar. Quiero que pase que cualquiera pueda abrir por dentro una pieza real del método — Claude escribe el brief, Codex pinta, y después se comprueba que no mintió — y salir sabiendo que una imagen puede salir bonita y aun así no haber sido generada.

Fíjate en la forma: «hoy pasa X, quiero que pase Y». No dice «hacer la página de la skill».

CRITERIOS DE EXITO

  1. 1

    Alguien que no estuvo en esta conversación descarga el .zip, lo descomprime en ~/.claude/skills/, abre Claude Code en una carpeta vacía, dice la frase de disparo y obtiene un archivo de imagen ahí — sin tocar ~/.codex/ ni crear ningún perfil

    Se comprueba con: Corrida real en carpeta limpia: ls del archivo entregado + carpeta nueva de hoy en ~/.codex/generated_images/ + md5sum de los dos iguales

    confirmado por otra persona, 2026-08-29

  2. 2

    La skill publicada no filtra contexto privado

    Se comprueba con: Dos greps sobre la carpeta descomprimida, 0 coincidencias en ambos: uno con nombres propios y otro con rutas de la máquina del autor

    0 y 0

  3. 3

    El sitio compila, pasa sus puertas y la página nueva es indexable

    Se comprueba con: Las cuatro puertas del repo más la URL en el sitemap. Ojo con eslint: el repo tiene línea base de 1 error heredado, así que el criterio es no subir de 1, no llegar a cero

    eslint en 1 (la base) · tsc limpio · build con la ruta · sitemap con la URL

  4. 4

    El texto que este trabajo añade se lee en modo claro y en oscuro

    Se comprueba con: Los tokens del tema con un script, y los textos nuevos medidos en el DOM con la fórmula WCAG contra su fondo real, comprobando antes en qué tema se está

    en claro 81 textos, 0 fallos · en oscuro 81 textos, 2 fallos y los dos son del footer heredado

  5. 5

    Quien lee la página sin instalar nada sabe explicar con sus palabras por qué una imagen puede salir correcta y aun así no estar generada

    Se comprueba con: Otra persona la lee en frío —no construyó esto— y lo cuenta de vuelta. Si tiene que releer para encontrarlo, el criterio NO se cumple

    confirmado, 2026-08-29

UNA FILA DE LA BITACORA

2026-08-28 — Criterio 1 queda parcial, no cumplido.

Verificado lo que sí se puede desde aquí: la receta publicada genera y guarda de punta a punta — carpeta nueva y md5 idéntico entre la copia del modelo y el archivo entregado. Lo que NO: que Claude Code dispare la skill instalada desde el .zip. Por definición no lo puedo cerrar yo — el criterio pide «alguien que no estuvo en esta conversación».

Quien construyó no pudo marcar el criterio como cumplido. Lo cerró otra persona un día después. Así se ve el método cuando funciona.

La trampa

Un trabajo puede estar «completado» y no cumplir.

Cuando la IA termina te dice «listo». Eso es lo que ella cree, no lo que pasó: es la misma que hizo el trabajo, mirándolo con el mismo punto ciego con que lo hizo. Un completado es una afirmación de quien lo escribió, no evidencia.

Por eso la segunda skill no pregunta «¿quedó bien?». Pregunta «¿puedo demostrar que NO?», criterio por criterio, y cada respuesta lleva su evidencia al lado: el comando que corrió, lo que devolvió. Y cuando un criterio no se puede comprobar desde ahí, lo dice con esas palabras — no verificable — en vez de marcarlo en verde.

Lo que devuelve no es una nota. Es una decisión: se integra o vuelve con el informe.

Llévatelas

Las dos skills son esta página convertida en algo que Claude Code lee solo. Descomprime el .zip en ~/.claude/skills/ de forma que quede así:

DONDE VA
En Windows, ~ es C:\Users\<tu-usuario>
~/.claude/skills/spec/SKILL.md
~/.claude/skills/spec/assets/SPEC-plantilla.md
~/.claude/skills/verificar-spec/SKILL.md

Después abre Claude Code en tu proyecto y pídelo con tus palabras: «vamos a construir una app para mi negocio» para la primera, «verifica que cumple» para la segunda. Dentro va un LÉEME con lo mismo, por si lo pierdes.

Ojo con el descompresor: si te creó una carpeta spec-driven/ con todo dentro, sube spec/ y verificar-spec/ un nivel, hasta que queden como arriba. Un nivel de más y Claude Code no las ve — y no avisa.

Gratis y sin dejar tu correo, como todo lo nuestro. Y sin nada que pagar aparte: solo Claude Code.