Founding Member: $499/mes de por vida
Micare
Trabajo con agentes

Banco de pruebas de herramientas

Un método (workflow) para decidir si adoptar una herramienta nueva: produce el mismo resultado con la nueva y con la que ya usas, califica ambos con la misma vara fijada de antemano, y recomienda por evidencia (calidad + costo + disponibilidad), no por corazonada.

WorkflowPremiumTrabajo con agentesproceso y metodo

🌱 Empieza aquí · Banco de pruebas de herramientas

Esta semilla le enseña a tu asistente un método para una decisión que se repite: sale una herramienta nueva y hay que decidir si la adoptas o si la que ya usas lo hace mejor. En vez de decidir por corazonada, tu asistente corre una prueba justa: produce el mismo resultado con las dos, las califica con la misma vara (fijada antes de ver resultados), y te da una recomendación con evidencia (calidad + costo + disponibilidad).

Para instalarla

Abre esta carpeta con Claude Code o Cowork y dile a tu asistente:

"Siembra esta semilla 🌱"

Con eso basta de tu parte. Tu asistente hace todo lo demás y al final te dice cómo comprobar que quedó funcionando. Vas a ver algunas palabras en inglés en la pantalla; ni caso, él te guía.

¿Otras formas de pedírselo? "instala esta semilla", "pon a funcionar el banco de pruebas de herramientas", "haz el setup de esto". Te entiende igual.


Para el asistente que siembra 🤖

Este componente es un workflow (método de trabajo), no un programa ejecutable. No es un hook (gancho de automatización): no lleva chmod, no lleva entrada en settings.json y no ejecuta ningún script. Se "siembra" colocando el método donde tú, el asistente, lo leas como instrucción permanente, para dispararlo por tu cuenta cuando aparezca una decisión de "¿adopto esta herramienta o no?".

1. Copia el método donde lo leas siempre

El kernel trae dos archivos:

  • kernel/banco-de-pruebas.md — el método en sí (las 4 fases del bake-off).
  • kernel/caso-de-prueba.ejemplo.md — una plantilla para aterrizar cada evaluación concreta.

Coloca banco-de-pruebas.md en el lugar que tu plataforma carga automáticamente como instrucción permanente:

Claude Code (macOS / Linux / Windows con Git Bash):

mkdir -p "$HOME/.claude/rules"
cp kernel/banco-de-pruebas.md "$HOME/.claude/rules/banco-de-pruebas.md"

Los archivos dentro de ~/.claude/rules/ se cargan solos al inicio de cada sesión. Copia ahí solo banco-de-pruebas.md. La plantilla NO va en esa carpeta: es una guía que usas cuando corres una evaluación concreta (paso 2).

Claude Code (Windows con PowerShell):

New-Item -ItemType Directory -Force -Path "$HOME\.claude\rules" | Out-Null
Copy-Item "kernel\banco-de-pruebas.md" "$HOME\.claude\rules\banco-de-pruebas.md"

Cowork: usa la misma carpeta de reglas si tu proyecto la soporta (.claude/rules/banco-de-pruebas.md). Si no, coloca banco-de-pruebas.md dentro del proyecto y agrega una línea que apunte a él en el archivo de instrucciones del proyecto (el CLAUDE.md), por ejemplo: "Cuando haya que decidir si adoptar una herramienta nueva, aplica el método de banco-de-pruebas.md."

Codex: Codex lee su archivo de instrucciones AGENTS.md. Copia el contenido de banco-de-pruebas.md dentro de AGENTS.md (o agrégale un puntero al archivo si lo guardas aparte en el proyecto), para que el método se cargue con el resto de tus instrucciones.

2. La plantilla, cuando llegue una evaluación real

kernel/caso-de-prueba.ejemplo.md NO se copia a la carpeta de reglas. Es la hoja que llenas (con la persona o tú) cada vez que evalúas una herramienta concreta: define el caso, la vara y el umbral antes de producir. Cópiala a la carpeta del proyecto donde correrás la prueba y ajústala a ese caso.

3. Verificación post-siembra (obligatoria)

Como es un método (texto), la verificación tiene dos partes: que el archivo quedó en su lugar, y que el método se aplica de verdad.

a) El archivo quedó colocado (ejemplo Claude Code):

ls -la "$HOME/.claude/rules/banco-de-pruebas.md"; echo "exit=$?"

Salida esperada: una línea que lista el archivo (con su tamaño) y exit=0. Si sale No such file or directory, la copia no se hizo; repite el paso 1.

b) El método se aplica (prueba de comportamiento, en una conversación nueva): Pídele a la persona que abra una sesión nueva y te lance algo como: "quiero probar [una herramienta nueva] contra lo que ya uso para [una tarea]; ¿la adopto?". La conducta correcta es que NO decidas de golpe: primero propongas fijar el criterio antes de producir (mismo caso de prueba para los dos lados + la vara + el umbral), corras el filtro de vale-la-pena, y solo después produzcas ambos resultados, los califiques con la misma vara y recomiendes con la diferencia de puntaje citada. Si en vez de eso opinas "adóptala" sin caso de prueba ni vara, el método no se cargó: revisa que banco-de-pruebas.md esté en la carpeta de reglas (o dentro de AGENTS.md en Codex).

Cuando ambas partes pasen, avísale a la persona en una línea qué gana con esto.


✅ ¿Cómo sé que funcionó?

La próxima vez que te tiente una herramienta nueva y le preguntes a tu asistente si vale la pena, ya no te va a contestar con una opinión suelta. Te va a proponer una prueba corta y justa: producir lo mismo con las dos, calificarlas parejo, y decirte cuál gana y por cuánto, sumando cuánto cuesta cada una y si están listas para usarse. Decides con evidencia, no con corazonada ni con lo que promete el vendedor. 🌱

¿Quieres implementarla con acompañamiento?

Agenda una asesoría directa con JP y aterrízala en tu caso · desde $600 MXN.

Agendar una asesoría