$
/hub:init
--task "Reescribir hero section + CTA de /pricing para maximizar trial signups"
--agents 4
--eval "python eval/llm_judge.py --criteria eval/criteria.yaml"
--metric conversion_score
--direction higher
✓
AgentHub session initialized
Sesión creada · estructura de directorios lista · baseline capturado
Configuración de Sesión
| Session ID |
20260612-094417 |
| Cliente |
FlowMetrics (SaaS B2B — RevOps analytics) |
| Tarea |
Reescribir hero section + CTA de /pricing para maximizar trial signups |
| Agentes |
4 agentes paralelos |
| Eval command |
python eval/llm_judge.py --criteria eval/criteria.yaml |
| Métrica |
conversion_score (higher is better) |
| Rama base |
main |
| Estado |
init |
Agentes configurados
Agent #1
Directo
Beneficio claro
sin rodeos
Agent #2
Emocional
Pain + aspiración
story-driven
Agent #3
Social Proof
Cifras + logos
+ testimonios
Agent #4
FOMO
Urgencia + límite
+ pérdida
Baseline capturado
conversion_score actual
41/100
copy actual de /pricing — LLM judge prerun
Debilidades detectadas:
Hero headline genérico sin diferenciación · CTA "Probar gratis" sin contexto de valor ·
Sin métricas sociales visibles · Propuesta de valor enterrada en párrafo 3
Criterios de evaluación (eval/criteria.yaml)
-
Claridad del mensaje — ¿se entiende el valor en <5 segundos?
30%
-
Relevancia ICP — ¿habla directamente al ops manager B2B?
25%
-
Urgencia / CTA — ¿la acción pedida es clara e irresistible?
25%
-
Diferenciación — ¿no podría decirlo cualquier competidor?
20%
Estructura creada en .agenthub/
.agenthub/
├── sessions/
│ └── 20260612-094417/
│ ├── config.yaml ← generado ahora
│ ├── agents/ ← 4 subdirs (agent-1 … agent-4)
│ └── results/ ← vacío, se llena con /hub:eval
└── state.json ← state: init
config.yaml generado
session_id: "20260612-094417"
client: "FlowMetrics"
task: "Reescribir hero section + CTA de /pricing para maximizar trial signups"
agents: 4
base_branch: "main"
state: "init"
eval:
command: "python eval/llm_judge.py --criteria eval/criteria.yaml"
metric: "conversion_score"
direction: "higher"
baseline: 41
criteria_weights:
claridad_mensaje: 0.30
relevancia_icp: 0.25
urgencia_cta: 0.25
diferenciacion: 0.20
agents_config:
- id: 1 style: "directo"
- id: 2 style: "emocional"
- id: 3 style: "social_proof"
- id: 4 style: "fomo"
Siguiente paso
/hub:spawn
20260612-094417
Lanza los 4 agentes en paralelo · cada uno en su propio git worktree · objetivo: superar baseline 41 → target 65+