AI Hub
ESEN

CONCEPTO · TOOLS

Testing como spec con Claude Code

Cómo pedirle a Claude Code tests que se lean como especificación humana y que de verdad validen comportamiento, no que solo pasen.

2 min de lectura · actualizado 2026-07

Contexto

Claude Code puede generar 50 tests en segundos. El problema no es la cantidad: es que esos tests validen comportamiento real y se lean como una especificación, no como código mecánico que pasa siempre. Usar Claude Code para testing es dirigir la generación con criterio, no delegar el criterio.

Configuración / setup

  1. Ten el runner de tests configurado en el proyecto (Vitest, Jest, Pytest, el que uses) antes de empezar.
  2. Dale contexto a Claude Code: qué función, qué comportamiento esperas, qué runner. El comando de test y las convenciones van idealmente en CLAUDE.md.
  3. Regla de oro (de las buenas prácticas de Claude Code): dale una forma de verificar su trabajo. Que corra los tests y lea el resultado, no que "parezca" que están bien.

Estado a julio 2026. Claude Code evoluciona; comandos y flags pueden cambiar.

Ejemplos

Un prompt que produce tests-como-spec:

Genera tests para canUserCheckout(user, cart) con Vitest.
Que cada test se lea como una frase de negocio, no como "test 1, test 2".
Cubre: verificado / no verificado, con / sin pedidos pendientes,
carrito vacío, usuario sin límite de crédito.
Después corre la suite y muéstrame el output.

Resultado esperable — los nombres son la spec:

describe('canUserCheckout', () => {
  it('permite checkout si está verificado y sin pedidos pendientes', ...)
  it('bloquea checkout si el usuario no está verificado', ...)
  it('bloquea checkout si hay un pedido pendiente de pago', ...)
})

Si Claude Code te da "100 tests que pasan" pero ninguno rompe cuando rompes el código a propósito, no valen. Pídele que los tests fallen al introducir un bug, como prueba de que validan algo.

Particularidades

  • Combina con edge-cases-with-ai: primero le pides que descubra los casos, después que los convierta en tests. Descubrir y cubrir son dos pasos distintos.
  • Verificación real: exige que corra la suite y muestre el output. "Looks done" no es done — es el principio central de las buenas prácticas de Claude Code.
  • Cobertura ≠ calidad: un número de coverage alto con tests que no asertan nada es humo. Prioriza comportamiento crítico sobre porcentaje.
  • Límite: Claude Code escribe tests correctos, pero tú decides QUÉ vale la pena testear. Ese criterio no se delega.

RELACIONADOS