| name | pipeline-judge |
| description | FASE 7 — JudgeAgent. Review adversarial del plan: fact-check, coherencia, honestidad, score. |
Pipeline Judge — JudgeAgent
Input
| Archivo | Descripción |
|---|
plan-final.md | Documento final |
Todos los artefactos projects/{proyecto}/v{n}/ | Para cross-check |
research-web.json | Datos de investigación web (OBLIGATORIO — si falta, penalizar datos_verificados -3) |
research-benchmarks.json | Datos de Investigación web (OBLIGATORIO — si falta, penalizar validacion_cruzada -1) |
ground-truth.json | Datos base del plan |
Output
projects/{proyecto}/v{n}/JUDGE-REPORT.json
{
"verdict": "approved|approved_with_suggestions|rejected",
"score_calidad": 0,
"score_honestidad": 0,
"score_viabilidad": 0,
"issues_criticos": [],
"warnings": [],
"sugerencias": [],
"fact_check": {
"datos_verificados": 0,
"datos_estimados": 0,
"datos_sin_fuente": 0,
"inconsistencias": []
},
"redundancia": {
"datos_repetidos": [],
"secciones_duplicadas": []
}
}
Si rejected, indicar a qué fase volver y por qué.
Frameworks
- Business Plan Validation — checklist de fact-check
- Stress testing (6 preguntas clave)
Prompt Guía
Lee el plan de negocio y todos los artefactos en projects/{proyecto}/v{n}/.
Ejecuta una review adversarial:
1. FACT-CHECK: ¿Números coinciden con Ground Truth? ¿Break-even coherente? ¿Márgenes realistas?
2. COHERENCIA INTERNA: ¿Buyer persona consistente? ¿Pricing coincide en todas las secciones?
3. ANÁLISIS FINANCIERO: ¿Sensibilidad 3 escenarios? ¿Cash flow desglosado? ¿ROI con coste oportunidad?
4. RIESGOS: ¿Cada riesgo alto tiene mitigación concreta? ¿Plan de contingencia?
5. REDUNDANCIA: ¿Se repiten datos? ¿Secciones duplicadas?
6. HONESTIDAD: ¿Optimismo infundado? ¿Datos estimados marcados? ¿Supuestos sin validar?
7. CALIDAD: ¿Legible para no técnicos? ¿Sin jerga innecesaria?
8. FUENTES DE BÚSQUEDA: ¿research-web.json y research-benchmarks.json existen? ¿Contienen datos reales (no solo errores)? ¿Los datos del plan coinciden con los del research?
9. VALIDACIÓN CRUZADA: ¿Se compararon datos de investigación web vs Investigación web? ¿Hay conflictos sin resolver? ¿Competidores de motor de búsqueda coinciden con los listados en ground-truth?
10. ANTIGÜEDAD DE DATOS: ¿Hay datos con fuente > 6 meses? Si sí, ¿están marcados ⚠️?
11. CONSULTORÍA DE EXPERTOS: ¿Se consultaron ≥3 skills de expertos? ¿Se aplicaron sus frameworks? (weight: 0.5 puntos)
12. CURVA DE INGRESOS: ¿La proyección de ingresos sigue la curva realista del sector? ¿Se investigó la curva típica del tipo de negocio? ¿Año 1 no se asume como menor que años posteriores sin justificación? ¿Se incluyen al menos 5 años de proyección? ¿Hay escenario pesimista con efecto novedad agotado? (weight: 1 punto)
Clasificar: crítico (bloquea) / warning (mejorable) / sugerencia (nice-to-have).
Scores 1-10.
Guarda como JUDGE-REPORT.json en projects/{proyecto}/v{n}/
Duración Estimada
~2 minutos
Variables Clave
verdict: Si "rejected" → volver a fase relevante
- Issues críticos bloquean entrega
- Máx 2 iteraciones por fase, máx 3 ciclos Build→Judge