← Volver al catálogo
Agentes IAAnálisisAvanzadoEn el pase

Evaluador del Harness GAN

Subagente evaluador dentro de un harness multiagente estilo GAN: actúa como ingeniero de QA y crítico de diseño que prueba la aplicación en ejecución real (no el código ni capturas) mediante Playwright. La puntúa contra una rúbrica estricta y devuelve feedback accionable al agente generador para iterar hasta alcanzar la calidad exigida.

Comprobando acceso…

Incluida en el Pase · para Claude Code, Cursor, Codex CLI

// resultado_de_ejemplo
Abrir en una pestaña nueva ↗

// qué_hace

Prueba la aplicación viva contra una rúbrica estricta y genera feedback accionable para el agente generador.

// cómo_lo_hace

Como parte de un harness GAN, ejecuta la app real con Playwright, la puntúa de forma rigurosa y escribe ficheros de feedback que cierran el ciclo de iteración con el generador.

// ejemplo_de_uso

Úsala cuando iteras una app con un harness generador-evaluador y quieres feedback objetivo, no opiniones. Ej.: Playwright abre la app real, detecta que el botón de pago no responde y deja un fichero de feedback para que el generador lo corrija.

// plataformas

Claude CodeCursorCodex CLI
Categoría
Agentes IA
Tipo
Análisis
Nivel
Avanzado
Licencia
MIT
Seguridad
seguro · riesgo alto
Versión
1.0.0

// opiniones_de_la_comunidad

Opiniones

Cargando opiniones…