Server definition
- Hash
- sha256:7d67d91a5044bec34aa6b1c729ade1fdac817778d494bd6868449daf50ebf048
- What it is
- What a remote MCP server returned when asked what it offers: 18 tools
The blob, as servednamed by its sha256
{
"instructions": "Este servidor expone la guía \"El Buen Agente\" como tools que evalúan y mejoran definiciones de agentes LLM. Las tools forman un flujo y conviene ejecutarlas EN ORDEN:\n\n**Agente NUEVO (diseño desde cero):**\n1. `evaluar_necesidad`: ¿hace falta un agente? (si no, frená acá)\n2. `revisar_rol_y_frontera` → 3. `revisar_outputs` → 4. `evaluar_autonomia` → 5. `revisar_frontera_ejecucion` → 6. `auditar_contexto` → 7. `disenar_evaluacion`\n8. `generar_contrato`: formaliza el diseño\n9. `checklist_nacimiento`. GATE FINAL: si NO APTO, volver a la sección que falló y re-correr\n10. `construir_agente`: genera la definición final del agente, lista para usar\n11. `plan_de_inicio`: plan de despliegue\n\n**Agente EXISTENTE (mejora):** empezá por `checklist_nacimiento` como diagnóstico, después profundizá solo en las secciones con estado falta usando la tool correspondiente, y cerrá re-corriendo `checklist_nacimiento`.\n\n**Transversales:** `aplicar_challenger` / `challenger_decision` después de cualquier rediseño; `evaluar_sistema` y `plan_exposicion_mcp` cuando el agente convive con otros o expone valor a terceros.\n\nCada respuesta de tool incluye el siguiente paso recomendado. Ante la duda, llamá `recomendar_flujo`.\n\nEN: This server turns the \"El Buen Agente\" guide into an ordered tool flow for evaluating and building LLM agents. All evaluation tools accept language:\"en\" for English output. Call `recomendar_flujo` first if unsure where to start.",
"tools": [
{
"description": "Aplica el patrón challenger/red-team a la definición o a una decisión del agente: contraargumentos basados en datos, autocrítica y gate de calidad. Útil como segunda pasada adversarial. Recibe la definición del agente y devuelve un brief de evaluación estructurado.",
"inputSchema": {
"$schema": "http://json-schema.org/draft-07/schema#",
"additionalProperties": false,
"properties": {
"agent_definition": {
"description": "Definición completa del agente a mejorar: system prompt, frontmatter, configuración, descripción de tools y cualquier doc de diseño. Cuanto más completa, mejor la evaluación.",
"minLength": 1,
"type": "string"
},
"language": {
"description": "Idioma de la respuesta (default \"es\"). / Response language: pass \"en\" for English output.",
"enum": [
"es",
"en"
],
"type": "string"
}
},
"required": [
"agent_definition"
],
"type": "object"
},
"name": "aplicar_challenger",
"outputSchema": null
},
{
"description": "Audita el contexto del agente: separación en 3 capas (identidad/dominio/referencia), relevancia y caducidad de datos, estrategia de integración (directo/snapshot/RAG/estático), gobernanza, least-privilege, trazabilidad y defensa anti prompt-injection. Recibe la definición del agente y devuelve un brief de evaluación estructurado.",
"inputSchema": {
"$schema": "http://json-schema.org/draft-07/schema#",
"additionalProperties": false,
"properties": {
"agent_definition": {
"description": "Definición completa del agente a mejorar: system prompt, frontmatter, configuración, descripción de tools y cualquier doc de diseño. Cuanto más completa, mejor la evaluación.",
"minLength": 1,
"type": "string"
},
"language": {
"description": "Idioma de la respuesta (default \"es\"). / Response language: pass \"en\" for English output.",
"enum": [
"es",
"en"
],
"type": "string"
}
},
"required": [
"agent_definition"
],
"type": "object"
},
"name": "auditar_contexto",
"outputSchema": null
},
{
"description": "Genera el brief para cuestionar una decisión concreta del agente: 3 razones basadas en datos para NO hacerla. No bloquea, informa al humano.",
"inputSchema": {
"$schema": "http://json-schema.org/draft-07/schema#",
"additionalProperties": false,
"properties": {
"contexto": {
"description": "Contexto y datos relevantes a la decisión.",
"type": "string"
},
"decision": {
"description": "La decisión o recomendación del agente que se quiere cuestionar.",
"type": "string"
},
"language": {
"description": "Idioma de la respuesta (default \"es\"). / Response language: pass \"en\" for English output.",
"enum": [
"es",
"en"
],
"type": "string"
}
},
"required": [
"decision"
],
"type": "object"
},
"name": "challenger_decision",
"outputSchema": null
},
{
"description": "Corre el checklist completo de 19 puntos contra la definición del agente. Es el gate final antes de mergear: el agente debe NACER cumpliéndolo, no corregirse después. Devuelve veredicto punto por punto.",
"inputSchema": {
"$schema": "http://json-schema.org/draft-07/schema#",
"additionalProperties": false,
"properties": {
"agent_definition": {
"description": "Definición completa del agente a mejorar: system prompt, frontmatter, configuración, descripción de tools y cualquier doc de diseño. Cuanto más completa, mejor la evaluación.",
"minLength": 1,
"type": "string"
},
"language": {
"description": "Idioma de la respuesta (default \"es\"). / Response language: pass \"en\" for English output.",
"enum": [
"es",
"en"
],
"type": "string"
}
},
"required": [
"agent_definition"
],
"type": "object"
},
"name": "checklist_nacimiento",
"outputSchema": null
},
{
"description": "El paso de CIERRE del flujo: toma la definición iterada (tras pasar por las revisiones) y produce el artefacto final listo para usar: identity layer, tools con least-privilege, límites duros, schema de output, gates, contexto, evaluación. Llamala cuando checklist_nacimiento dé APTO.",
"inputSchema": {
"$schema": "http://json-schema.org/draft-07/schema#",
"additionalProperties": false,
"properties": {
"contrato": {
"description": "El contrato generado por generar_contrato, si existe.",
"type": "string"
},
"definicion_final": {
"description": "Definición completa del agente a mejorar: system prompt, frontmatter, configuración, descripción de tools y cualquier doc de diseño. Cuanto más completa, mejor la evaluación.",
"minLength": 1,
"type": "string"
},
"formato": {
"description": "Formato del artefacto: 'markdown' (doc de diseño completo, default), 'claude_skill' (SKILL.md con frontmatter), 'system_prompt' (prompt + config para cualquier framework).",
"enum": [
"markdown",
"claude_skill",
"system_prompt"
],
"type": "string"
},
"language": {
"description": "Idioma de la respuesta (default \"es\"). / Response language: pass \"en\" for English output.",
"enum": [
"es",
"en"
],
"type": "string"
}
},
"required": [
"definicion_final"
],
"type": "object"
},
"name": "construir_agente",
"outputSchema": null
},
{
"description": "Evalúa el plan de evaluación del agente (o ayuda a crearlo): 3 dimensiones (capacidades/trayectoria/resultado), métricas (tasa de éxito, consistencia, coste por tarea, adopción), golden set de 20-50 tareas, monitoreo de drift y self-consistency para alto stake.",
"inputSchema": {
"$schema": "http://json-schema.org/draft-07/schema#",
"additionalProperties": false,
"properties": {
"agent_definition": {
"description": "Definición completa del agente a mejorar: system prompt, frontmatter, configuración, descripción de tools y cualquier doc de diseño. Cuanto más completa, mejor la evaluación.",
"minLength": 1,
"type": "string"
},
"language": {
"description": "Idioma de la respuesta (default \"es\"). / Response language: pass \"en\" for English output.",
"enum": [
"es",
"en"
],
"type": "string"
}
},
"required": [
"agent_definition"
],
"type": "object"
},
"name": "disenar_evaluacion",
"outputSchema": null
},
{
"description": "Determina el nivel de autonomía adecuado (copiloto / ejecutor supervisado / autónomo con guardrails) y verifica los mecanismos de reducción de riesgo: sandbox/shadow mode, límites duros, frenos progresivos, override humano. Recibe la definición del agente y devuelve un brief de evaluación estructurado.",
"inputSchema": {
"$schema": "http://json-schema.org/draft-07/schema#",
"additionalProperties": false,
"properties": {
"agent_definition": {
"description": "Definición completa del agente a mejorar: system prompt, frontmatter, configuración, descripción de tools y cualquier doc de diseño. Cuanto más completa, mejor la evaluación.",
"minLength": 1,
"type": "string"
},
"language": {
"description": "Idioma de la respuesta (default \"es\"). / Response language: pass \"en\" for English output.",
"enum": [
"es",
"en"
],
"type": "string"
}
},
"required": [
"agent_definition"
],
"type": "object"
},
"name": "evaluar_autonomia",
"outputSchema": null
},
{
"description": "Evalúa si el problema justifica un agente o se resuelve con menos (prompt, workflow, skill). Detecta antipatrones: agente genérico, sobre-orquestación, agente sin contexto, autonomía total día 1. Usala ANTES de construir, o para cuestionar un agente existente.",
"inputSchema": {
"$schema": "http://json-schema.org/draft-07/schema#",
"additionalProperties": false,
"properties": {
"language": {
"description": "Idioma de la respuesta (default \"es\"). / Response language: pass \"en\" for English output.",
"enum": [
"es",
"en"
],
"type": "string"
},
"problema": {
"description": "Descripción del problema que se quiere resolver y, si existe, cómo lo resuelve el agente actual.",
"type": "string"
}
},
"required": [
"problema"
],
"type": "object"
},
"name": "evaluar_necesidad",
"outputSchema": null
},
{
"description": "Evalúa cómo el agente encaja en el sistema mayor: catálogo de skills, reutilización vs especialización, orquestación ligera vs orquestador, qué automatizar vs supervisar, y memorias separadas por agente.",
"inputSchema": {
"$schema": "http://json-schema.org/draft-07/schema#",
"additionalProperties": false,
"properties": {
"agent_definition": {
"description": "Definición completa del agente a mejorar: system prompt, frontmatter, configuración, descripción de tools y cualquier doc de diseño. Cuanto más completa, mejor la evaluación.",
"minLength": 1,
"type": "string"
},
"ecosistema": {
"description": "Otros agentes/skills existentes en el sistema, si los hay.",
"type": "string"
},
"language": {
"description": "Idioma de la respuesta (default \"es\"). / Response language: pass \"en\" for English output.",
"enum": [
"es",
"en"
],
"type": "string"
}
},
"required": [
"agent_definition"
],
"type": "object"
},
"name": "evaluar_sistema",
"outputSchema": null
},
{
"description": "Genera el contrato formal del agente (patrón contractor de §8) a partir de los campos provistos. Los campos faltantes quedan marcados como [PENDIENTE] para completar.",
"inputSchema": {
"$schema": "http://json-schema.org/draft-07/schema#",
"additionalProperties": false,
"properties": {
"autonomia": {
"description": "copiloto | supervisado | autónomo con guardrails (+ plan de progresión).",
"type": "string"
},
"coste": {
"description": "Modelo + estimado de tokens/mes + tope.",
"type": "string"
},
"evaluacion": {
"description": "Métricas de éxito (verde/amarillo/rojo) + cadencia de review.",
"type": "string"
},
"inputs": {
"description": "Qué consume.",
"type": "string"
},
"language": {
"description": "Idioma de la respuesta (default \"es\"). / Response language: pass \"en\" for English output.",
"enum": [
"es",
"en"
],
"type": "string"
},
"no_puede": {
"description": "Acciones que requieren aprobación humana / fuera de alcance.",
"type": "string"
},
"nombre": {
"description": "Nombre del agente.",
"type": "string"
},
"output": {
"description": "Schema exacto + formato legible para humano.",
"type": "string"
},
"problema": {
"description": "Qué resuelve (1 frase) + qué deliberadamente NO toca.",
"type": "string"
},
"puede": {
"description": "Acciones autónomas dentro de límites.",
"type": "string"
}
},
"required": [
"nombre"
],
"type": "object"
},
"name": "generar_contrato",
"outputSchema": null
},
{
"description": "Devuelve la guía completa 'El Buen Agente (v2)' en Markdown. Usala para contexto general; para operar sobre un agente concreto usá las tools evaluar_*/revisar_*/auditar_*.",
"inputSchema": {
"$schema": "http://json-schema.org/draft-07/schema#",
"properties": {},
"type": "object"
},
"name": "get_el_buen_agente",
"outputSchema": null
},
{
"description": "Genera el plan de arranque correcto para un agente nuevo: un agente, un problema concreto, un humano revisando. Verifica que la tarea elegida sea recurrente, costosa en tiempo y con datos accesibles.",
"inputSchema": {
"$schema": "http://json-schema.org/draft-07/schema#",
"additionalProperties": false,
"properties": {
"equipo": {
"description": "Quiénes lo van a usar y revisar.",
"type": "string"
},
"language": {
"description": "Idioma de la respuesta (default \"es\"). / Response language: pass \"en\" for English output.",
"enum": [
"es",
"en"
],
"type": "string"
},
"problema": {
"description": "El problema o tarea candidata para el primer agente.",
"type": "string"
}
},
"required": [
"problema"
],
"type": "object"
},
"name": "plan_de_inicio",
"outputSchema": null
},
{
"description": "Evalúa qué partes del agente conviene exponer a la economía de agentes y cómo: qué modelar como tool (capacidad accionable), resource (doc/dato legible) o prompt (plantilla), y qué merece UI vs API/MCP.",
"inputSchema": {
"$schema": "http://json-schema.org/draft-07/schema#",
"additionalProperties": false,
"properties": {
"agent_definition": {
"description": "Definición completa del agente a mejorar: system prompt, frontmatter, configuración, descripción de tools y cualquier doc de diseño. Cuanto más completa, mejor la evaluación.",
"minLength": 1,
"type": "string"
},
"language": {
"description": "Idioma de la respuesta (default \"es\"). / Response language: pass \"en\" for English output.",
"enum": [
"es",
"en"
],
"type": "string"
}
},
"required": [
"agent_definition"
],
"type": "object"
},
"name": "plan_exposicion_mcp",
"outputSchema": null
},
{
"description": "Devuelve el flujo recomendado de tools según la situación: agente nuevo (diseño desde cero) o agente existente (mejora). Llamala PRIMERO si no sabés por dónde empezar.",
"inputSchema": {
"$schema": "http://json-schema.org/draft-07/schema#",
"additionalProperties": false,
"properties": {
"situacion": {
"description": "'nuevo' = diseñar un agente desde cero; 'existente' = mejorar un agente que ya está definido o en producción.",
"enum": [
"nuevo",
"existente"
],
"type": "string"
}
},
"required": [
"situacion"
],
"type": "object"
},
"name": "recomendar_flujo",
"outputSchema": null
},
{
"description": "Verifica que la línea entre lo que el agente recomienda y lo que ejecuta esté definida en código (status + gates), no descubierta en producción: qué ejecuta directo, qué queda pendiente de aprobación, qué se rechaza. Recibe la definición del agente y devuelve un brief de evaluación estructurado.",
"inputSchema": {
"$schema": "http://json-schema.org/draft-07/schema#",
"additionalProperties": false,
"properties": {
"agent_definition": {
"description": "Definición completa del agente a mejorar: system prompt, frontmatter, configuración, descripción de tools y cualquier doc de diseño. Cuanto más completa, mejor la evaluación.",
"minLength": 1,
"type": "string"
},
"language": {
"description": "Idioma de la respuesta (default \"es\"). / Response language: pass \"en\" for English output.",
"enum": [
"es",
"en"
],
"type": "string"
}
},
"required": [
"agent_definition"
],
"type": "object"
},
"name": "revisar_frontera_ejecucion",
"outputSchema": null
},
{
"description": "Verifica que los outputs sean accionables: schema estricto (JSON Schema/Pydantic), resumen legible para humanos separado del razonamiento, y exposición de qué gates pasó/falló. Recibe la definición del agente y devuelve un brief de evaluación estructurado.",
"inputSchema": {
"$schema": "http://json-schema.org/draft-07/schema#",
"additionalProperties": false,
"properties": {
"agent_definition": {
"description": "Definición completa del agente a mejorar: system prompt, frontmatter, configuración, descripción de tools y cualquier doc de diseño. Cuanto más completa, mejor la evaluación.",
"minLength": 1,
"type": "string"
},
"language": {
"description": "Idioma de la respuesta (default \"es\"). / Response language: pass \"en\" for English output.",
"enum": [
"es",
"en"
],
"type": "string"
}
},
"required": [
"agent_definition"
],
"type": "object"
},
"name": "revisar_outputs",
"outputSchema": null
},
{
"description": "Verifica que el agente tenga rol claro, dominio acotado y frontera explícita de qué NO es su responsabilidad, escrita en el identity layer y enforced en código donde se pueda. Recibe la definición del agente y devuelve un brief de evaluación estructurado.",
"inputSchema": {
"$schema": "http://json-schema.org/draft-07/schema#",
"additionalProperties": false,
"properties": {
"agent_definition": {
"description": "Definición completa del agente a mejorar: system prompt, frontmatter, configuración, descripción de tools y cualquier doc de diseño. Cuanto más completa, mejor la evaluación.",
"minLength": 1,
"type": "string"
},
"language": {
"description": "Idioma de la respuesta (default \"es\"). / Response language: pass \"en\" for English output.",
"enum": [
"es",
"en"
],
"type": "string"
}
},
"required": [
"agent_definition"
],
"type": "object"
},
"name": "revisar_rol_y_frontera",
"outputSchema": null
},
{
"description": "Cierra el ciclo de checklist_nacimiento con un contrato a nivel protocolo. Pasale los 19 puntos con su estado (ok|parcial|falta) y devuelve structuredContent validado: conteos y veredicto normalizado (apto solo si faltas === 0). Pensada para consumo programático / gates de CI: no depende de parsear texto.",
"inputSchema": {
"$schema": "http://json-schema.org/draft-07/schema#",
"additionalProperties": false,
"properties": {
"puntos": {
"description": "Los 19 puntos del checklist con su estado evaluado.",
"items": {
"additionalProperties": false,
"properties": {
"estado": {
"enum": [
"ok",
"parcial",
"falta"
],
"type": "string"
},
"n": {
"maximum": 19,
"minimum": 1,
"type": "integer"
}
},
"required": [
"n",
"estado"
],
"type": "object"
},
"maxItems": 19,
"minItems": 19,
"type": "array"
}
},
"required": [
"puntos"
],
"type": "object"
},
"name": "validar_veredicto",
"outputSchema": {
"$schema": "http://json-schema.org/draft-07/schema#",
"additionalProperties": false,
"properties": {
"aptos": {
"type": "integer"
},
"completo": {
"description": "true si están los 19 puntos sin números repetidos.",
"type": "boolean"
},
"faltas": {
"type": "integer"
},
"parciales": {
"type": "integer"
},
"veredicto": {
"enum": [
"apto",
"no_apto"
],
"type": "string"
}
},
"required": [
"aptos",
"parciales",
"faltas",
"veredicto",
"completo"
],
"type": "object"
}
}
]
}Verify it yourself
curl -s https://api.teppi.xyz/v1/evidence/sha256:7d67d91a5044bec34aa6b1c729ade1fdac817778d494bd6868449daf50ebf048 | sha256sum