CONCEPTO · TOOLS
Testing como spec con Claude Code
Cómo pedirle a Claude Code tests que se lean como especificación humana y que de verdad validen comportamiento, no que solo pasen.
2 min de lectura · actualizado 2026-07
ANTES DE LEER
Contexto
Claude Code puede generar 50 tests en segundos. El problema no es la cantidad: es que esos tests validen comportamiento real y se lean como una especificación, no como código mecánico que pasa siempre. Usar Claude Code para testing es dirigir la generación con criterio, no delegar el criterio.
Configuración / setup
- Ten el runner de tests configurado en el proyecto (Vitest, Jest, Pytest, el que uses) antes de empezar.
- Dale contexto a Claude Code: qué función, qué comportamiento esperas, qué runner. El comando de test y las convenciones van idealmente en
CLAUDE.md. - Regla de oro (de las buenas prácticas de Claude Code): dale una forma de verificar su trabajo. Que corra los tests y lea el resultado, no que "parezca" que están bien.
Estado a julio 2026. Claude Code evoluciona; comandos y flags pueden cambiar.
Ejemplos
Un prompt que produce tests-como-spec:
Genera tests para canUserCheckout(user, cart) con Vitest.
Que cada test se lea como una frase de negocio, no como "test 1, test 2".
Cubre: verificado / no verificado, con / sin pedidos pendientes,
carrito vacío, usuario sin límite de crédito.
Después corre la suite y muéstrame el output.Resultado esperable — los nombres son la spec:
describe('canUserCheckout', () => {
it('permite checkout si está verificado y sin pedidos pendientes', ...)
it('bloquea checkout si el usuario no está verificado', ...)
it('bloquea checkout si hay un pedido pendiente de pago', ...)
})Si Claude Code te da "100 tests que pasan" pero ninguno rompe cuando rompes el código a propósito, no valen. Pídele que los tests fallen al introducir un bug, como prueba de que validan algo.
Particularidades
- Combina con
edge-cases-with-ai: primero le pides que descubra los casos, después que los convierta en tests. Descubrir y cubrir son dos pasos distintos. - Verificación real: exige que corra la suite y muestre el output. "Looks done" no es done — es el principio central de las buenas prácticas de Claude Code.
- Cobertura ≠ calidad: un número de coverage alto con tests que no asertan nada es humo. Prioriza comportamiento crítico sobre porcentaje.
- Límite: Claude Code escribe tests correctos, pero tú decides QUÉ vale la pena testear. Ese criterio no se delega.