Framework de desarrollo con IA

El humano dirige.
La IA ejecuta.
kbspec mide.

El framework que le pone método al desarrollo con IA: cada requerimiento es un expediente trazable de ocho fases, con el consumo, el costo y el ritmo medidos de verdad.

Un solo CLI en Python · cero dependencias GitHub Copilot · Claude · Azure DevOps
Por qué existe

Escribir código con IA es 10× más rápido. Entregarlo, no.

El asistente acelera una sola parte del trabajo. Lo demás —entender, revisar, medir, coordinar— sigue ahí, y ahora pesa más.

01 — el cuello se movió

La revisión, no la escritura

Con agentes, los PRs crecen 154% y el tiempo de revisión 91%. Generar código dejó de ser el problema; confiar en él es el nuevo.

Fuente: datos de industria sobre agentes
02 — la sensación miente

Ir más rápido, sentirlo

Un ensayo controlado midió desarrolladores 19% más lentos con IA — que creían haber ido 20% más rápido. La auto-estimación ya no sirve.

Fuente: METR RCT, 2025
03 — nadie mide

¿Cuánto costó, de verdad?

Los frameworks spec-driven descomponen y ordenan, pero ninguno mide el consumo ni el costo real del modelo. El dato no existe.

BMAD · Spec Kit · Kiro
Qué lo hace distinto

Cuatro cosas que ningún prompt te da solo.

Mide de verdad

Tokens, costo y ritmo, medidos por fase desde la telemetría real. Pronóstico por flujo con Monte Carlo. No estimás: medís.

kb tokens · kb flujo · kb pronostico

Método con compuertas

Ocho fases, de la captura a la entrega. kb listo no te deja implementar sobre un análisis flojo, ni cerrar sin criterios.

captura → … → entrega

Trazabilidad total

Un expediente por requerimiento, con bitácora encadenada por hash. Nada se pierde, nada se inventa: el «por qué» de cada decisión queda escrito.

expediente · auditoria.jsonl

Nativo de tu stack

GitHub Copilot, Claude y Azure DevOps, de fábrica. Un solo CLI en Python que es el único que escribe; skills, MCP y el panel de VS Code lo invocan.

Copilot · Claude · Azure DevOps · MCP
El ciclo

Ocho fases. Una sesión decide en cuál estás.

Nadie tiene que memorizar comandos: se escribe lo que se quiere y el framework decide la fase y qué sigue. La línea se enciende hacia la entrega.

Captura
La solicitud y las preguntas abiertas.
1
Requerimiento
RF/RN y criterios de aceptación.
◆ aprobación del usuario
2
Análisis técnico
Matriz de impacto, ADRs y riesgos.
3
Plan de tareas
WBS, work items y dependencias.
4
Implementación
Una tarea a la vez, cada una validada.
◆ kb listo
5
Pruebas
Unitarias y E2E, en lenguaje de negocio.
6
Validación
UAT, hallazgos y aceptación.
7
Entrega
PR, despliegue y base de conocimiento.
◆ kb retro
8
◆ compuerta — no se avanza sin pasarla
Medición que nadie más da

El dato propio, no el benchmark ajeno.

kbspec lee la telemetría real de Copilot y Claude, y la cruza con lo que salió. Tres respuestas que antes eran opinión.

Ritmo real

Ítems cerrados por sprint, del histórico de las bitácoras.

# kb flujo
16-Ago a 29-Ago ████████████ 16
02-Ago a 15-Ago ██████████ 13
Ritmo 13.3/sprint · rango 8–16

Pronóstico honesto

Monte Carlo sobre tu historia. Confianza, no adivinanza.

# kb pronostico --items 50
50% → ≤ 4 sprints
85% → ≤ 5 sprints (08-Nov)
costo ≈ $142 medido

Modelo por fase

Detecta si una fase corrió con un modelo demasiado flojo.

# kb modelo --revisar
3. Análisis usó rapido
recomienda RAZONAMIENTO
→ el análisis flojo se paga después
Comparación

La descomposición la hacen todos. La medición, no.

kbspec comparte lo bueno del enfoque spec-driven —y agrega la capa que los demás dejan afuera.

CapacidadkbspecBMADSpec KitKiro
Ciclo con fases y compuertasParcialParcial
Descomposición en tareas
Mide consumo y costo del modeloNoNoNo
Pronóstico por flujo (Monte Carlo)ConteoNoNo
Recomienda y mide el modelo por faseNoNoNo
Bitácora encadenada y auditableNoNoNo
Nativo de Azure DevOpsNoNoNo
Español de primera claseNoNoNo
Cómo se siente

Se escribe lo que se quiere. El framework hace el resto.

# En el chat de Copilot o Claude — o en la terminal
$ kb init KB-4471 "el usuario necesita ver sus perfiles por módulo" --tamano M

   expediente creado · fase captura
   00-INDICE.md · 01-solicitud.md

$ kb listo            # ¿está listo para implementar?
   LISTO — criterios aprobados, plan cubierto, fichas frescas

$ kb pronostico --backlog
  85% de confianza  →  ≤ 5 sprints   (para el 08-Nov)
  costo de modelo estimado: ≈ $142 · medido
Preguntas

Lo que casi todos preguntan.

¿kbspec reemplaza a Copilot o a Claude?

No. kbspec es el método y la medición alrededor de ellos. El asistente sigue escribiendo el código; kbspec le da la estructura, las compuertas y el dato de cuánto costó y cuánto rinde.

¿Por qué no usa story points?

Porque estiman el tiempo de una persona programando — y con IA esa cuenta se rompe. kbspec mide el flujo real (ítems cerrados por sprint) y proyecta con Monte Carlo, que es adonde llegaron los frameworks spec-driven serios. Sin planning poker.

¿Qué necesito para empezar?

Python 3.9+, Git, y tu asistente (Copilot o Claude). El CLI no tiene dependencias. Un comando lo instala y /kb-instalar te guía desde el chat.

¿Sirve para un equipo o solo para una persona?

Para las dos. El expediente y la bitácora son de cada requerimiento; la configuración (modelos, perfiles, convenciones, tablero) es del equipo y vive versionada en el repositorio de documentación.

¿Se integra con Azure DevOps?

De fábrica. kbspec crea el work item del requerimiento y una sub-tarea por cada T-NN, y les mueve el estado solo conforme avanza el ciclo.

Empezá hoy

Ponele número a tu desarrollo con IA.

La documentación completa, la guía de instalación y la referencia de comandos — todo en un solo lugar.