Founding Member: $499/mes de por vida
Micare
Trabajo con agentes

Contralor de agentes · consolida a tus jueces y entrena tu flota

Un agente con dos sombreros para cuando ya tienes VARIOS agentes trabajando. Como CONTRALOR, junta los veredictos de tus jueces o auditores —cada uno revisó una parte de tu sistema— en UN solo veredicto de salud, marca en qué se contradicen entre ellos, y lo hace desde un contexto aparte para no ser juez y parte: te reporta a ti, no al que coordina el trabajo. Como COACH, hace que cada agente mejore con el tiempo: audita sus definiciones y asciende SOLO los patrones ya probados (los que aparecieron 2+ veces) a un archivo común, sin duplicar. Ni él ni sus jueces firman nada: cada veredicto es una hipótesis hasta que tú lo validas.

AgentePremiumTrabajo con agentescalidad y jueces

Empieza aquí 🌱 · Contralor de agentes

Abre esta carpeta con Claude Code o Cowork y dile a tu asistente: "siembra esta semilla 🌱"

Con eso basta de tu parte. Tu asistente hace todo lo técnico por ti y al final te dice cómo comprobar que quedó. Tú solo confirmas cuando te pregunte. Vas a ver algunas palabras en inglés en la pantalla; ni caso, él te guía.

¿Otras formas de pedirlo? "instala esta semilla", "activa este agente", "pon el contralor de agentes a funcionar". Te entiende igual.

¿Qué es y qué resuelve?

Para quién es. Esta semilla es para cuando ya no tienes un asistente, sino varios agentes trabajando para ti: uno que revisa tus notas, otro tus memorias, otro que caza errores que se repiten. Llega un punto en que necesitas a alguien que ponga orden por encima de todos ellos. Ese es el system-judge.

Sombrero 1 · El contralor. Cuando tus agentes-auditores terminan, cada uno te deja su propio reporte. Leerlos todos y juntarlos en tu cabeza es trabajo. El contralor los junta en un solo veredicto de salud, te dice en qué se contradicen entre ellos, y —esto es clave— vive en un contexto aparte del que coordina el trabajo diario, para que no sea juez y parte. Te reporta a ti, no a "su jefe".

Sombrero 2 · El coach. Con el tiempo, tus agentes deberían volverse mejores. El coach revisa lo que aprendieron y asciende solo lo que ya se probó (un truco que funcionó una vez puede ser suerte; uno que funcionó dos veces ya es patrón) a un archivo común, para que todos lo hereden sin repetirlo. Así tus agentes mejoran sin engordar.

La regla de oro de ambos sombreros. Nada de lo que dice es una firma. Su veredicto es una hipótesis que te sube con evidencia para que decidas. Un "todo bien" suyo no aprueba nada por ti.


Para el asistente que siembra 🤖

Eres el asistente. Sigue estos pasos con precisión. Esto es un agente (un subagente con nombre propio), no un hook ni un script: se instala copiando un archivo Markdown a la carpeta de agentes del usuario. La plataforma lo descubre solo al leer esa carpeta. Sin chmod y sin settings.json.

Paso 1 · Copiar el archivo del kernel

El kernel principal es un solo archivo: kernel/system-judge.md. Cópialo a la carpeta de agentes del usuario según su plataforma.

  • macOS / Linux (Claude Code o Cowork):

    mkdir -p ~/.claude/agents
    cp kernel/system-judge.md ~/.claude/agents/system-judge.md
    
  • Windows (Claude Code o Cowork):

    mkdir -p "$USERPROFILE/.claude/agents"
    cp kernel/system-judge.md "$USERPROFILE/.claude/agents/system-judge.md"
    
  • Codex: Codex no maneja "subagentes con nombre" como Claude Code. Ahí no se copia como agente: pega el contenido de kernel/system-judge.md dentro de tu archivo de instrucciones AGENTS.md (o guárdalo aparte en el proyecto y agrégale un puntero), para que el método de consolidar jueces y entrenar la flota se cargue con el resto de tus instrucciones y lo apliques tú mismo cuando toque.

Paso 2 · Aterrizar la flota y los sub-jueces (opcional pero recomendado)

El kernel ya funciona con categorías genéricas, así que sirve sin configurar nada. Para que acierte más, abre kernel/flota-y-jueces.ejemplo.md: ahí listas los sub-jueces reales del usuario y qué audita cada uno (para el sombrero contralor), y le dices dónde viven sus agentes, su archivo de patrones compartidos y sus aprendizajes (para el sombrero coach). Reemplaza los placeholders <TU-CARPETA-DE-AGENTES>, <TU-ARCHIVO-DE-PATRONES>, <TU-CARPETA-DE-APRENDIZAJES> y <TU-ARCHIVO-DE-INSTRUCCIONES> por las rutas reales. Si el usuario todavía no tiene sub-jueces, no pasa nada: el sombrero coach ya sirve solo, y el contralor entra en cuanto los tenga.

Paso 3 · Verificación post-siembra (obligatoria)

No declares "listo" sin correr esto. Confirma que el archivo llegó a su sitio y que su encabezado (frontmatter) quedó bien formado.

grep -m1 '^name:' ~/.claude/agents/system-judge.md

Salida esperada:

name: system-judge

En Windows, cambia ~ por "$USERPROFILE". Si no imprime nada, revisa que el archivo se haya copiado a la carpeta agents (no a hooks) y que el nombre sea exactamente system-judge.md. En Claude Code, el comando /agents debe listar system-judge entre los agentes disponibles; si aparece ahí, ya se puede invocar.

Prueba de comportamiento (recomendada): en una sesión nueva, pásale al agente dos reportes cortos de "auditores" que se contradigan en algo, y pídele: "consolida estos dos reportes". La conducta correcta es que junte los dos en un veredicto, marque explícitamente la contradicción y cierre diciendo que su veredicto es una hipótesis pendiente de tu firma — no que apruebe nada por su cuenta. Si hace eso, quedó sembrado.

Ajustes opcionales que el usuario puede pedirte después

  • Modelo — la línea model: opus. Consolidar jueces y coachear definiciones es tarea de razonamiento, por eso el default es un modelo fuerte; cámbiala si el usuario prefiere otro.
  • Umbral para ascender patrones — por defecto un patrón sube al archivo compartido cuando ya se repitió 2+ veces (Regla de Tres). Se ajusta en la plantilla flota-y-jueces.ejemplo.md.

¿Cómo sé que funcionó?

Cuando tu asistente termine, pídele que corra la verificación de arriba y te muestre el resultado. Si aparece name: system-judge, ya quedó sembrado.

De ahí en adelante tienes dos superpoderes. Uno: cuando tus auditores terminen, dile "consolida la contraloría" y recibes una sola foto de salud de todo tu sistema, con las contradicciones entre ellos marcadas. Dos: al cerrar una sesión, dile "pasa el coach a mis agentes" y tus agentes se van afinando solos, ascendiendo únicamente lo que ya se probó. Lo que no va a pasar —y ese es el punto— es que alguien apruebe la salud de tu sistema en tu nombre: todo te llega como hipótesis para que tú firmes. 🌱

Inspiración y crédito

Fuentes y patrones abiertos que inspiraron esta semilla. Nos gusta reconocer de dónde vienen las buenas ideas.

  • El patrón de un juez que AGREGA y contrasta el trabajo de otros jueces sin ejecutarlo él mismo (Meta-Judge, sobre Orquestador-Trabajadores + Evaluador), y el uso de un modelo como evaluador en un contexto SEPARADO del que produce el trabajo (LLM-as-judge, para evitar el sesgo de auto-preferencia), descritos por Anthropic en su artículo de ingeniería "Building Effective Agents" (2024).
  • La regla de "solo asciende lo probado" se apoya en la Regla de Tres de Martin Fowler (abstraer/promover al tercer uso, no antes) aplicada a patrones de agentes en vez de a código. La semilla usa el principio; no incluye texto ni código de ninguna de las fuentes.

¿Quieres implementarla con acompañamiento?

Agenda una asesoría directa con JP y aterrízala en tu caso · desde $600 MXN.

Agendar una asesoría