Evaluador del Harness GAN
Subagente evaluador dentro de un harness multiagente estilo GAN: actúa como ingeniero de QA y crítico de diseño que prueba la aplicación en ejecución real (no el código ni capturas) mediante Playwright. La puntúa contra una rúbrica estricta y devuelve feedback accionable al agente generador para iterar hasta alcanzar la calidad exigida.
Incluida en el Pase · para Claude Code, Cursor, Codex CLI
// qué_hace
Prueba la aplicación viva contra una rúbrica estricta y genera feedback accionable para el agente generador.
// cómo_lo_hace
Como parte de un harness GAN, ejecuta la app real con Playwright, la puntúa de forma rigurosa y escribe ficheros de feedback que cierran el ciclo de iteración con el generador.
// ejemplo_de_uso
Úsala cuando iteras una app con un harness generador-evaluador y quieres feedback objetivo, no opiniones. Ej.: Playwright abre la app real, detecta que el botón de pago no responde y deja un fichero de feedback para que el generador lo corrija.
// plataformas
// opiniones_de_la_comunidad
Opiniones
Cargando opiniones…