Evaluador de Resultados de Agentes (AgentHub)
Evalua y clasifica los resultados de multiples agentes paralelos en una sesion de AgentHub, usando metricas de rendimiento, juicio LLM o modo hibrido para determinar el agente ganador.
Incluida en el Pase · para Claude Code, git, AgentHub
// qué_hace
Clasifica y puntua los resultados de agentes paralelos para identificar el ganador de una sesion multi-agente.
// cómo_lo_hace
Ejecuta un comando de evaluacion en cada worktree (modo metrica), compara diffs con juicio LLM (modo juez), o combina ambos en modo hibrido con desempate automatico.
// ejemplo_de_uso
Úsala en proyectos donde lanzas varios agentes en paralelo para resolver la misma tarea y necesitas saber cuál lo hizo mejor. Ej.: compara tres agentes de generación de código y elige el que produjo el diff más limpio.
// plataformas
// opiniones_de_la_comunidad
Opiniones
Cargando opiniones…