Sistema Multiagente

56 agentes especializados que evalúan ideas, construyen productos y los llevan al mercado.
Desde prompting manual hasta un CIO autónomo con tool_use real.

50
Agentes
5
Niveles
3
Flujos
3
Loops
6
Tools CIO

✅ Nivel 5 activo  El CIO corre sobre claude-opus-4-8 con tool_use real. Decide autónomamente qué agentes invocar, en paralelo donde sea posible, aplicando loops de calidad y evaluando compuertas de fase. No hay secuencia hardcodeada — el LLM decide.


⚡ Quickstart

1
Instalar
cd "Skills - Business & AI/runtime"
pip install anthropic rich python-dotenv nest_asyncio --break-system-packages

Crear runtime/.env:

ANTHROPIC_API_KEY=sk-ant-tu-clave-aqui
2
Crear proyecto
python main.py new

Pregunta nombre y dónde guardarlo. Acepta cualquier ruta:

/Users/gustavo/Startups/fitroute
~/Documentos/Proyectos
(Enter)  →  runtime/projects/fitroute
3
Ejecutar
# Flow con loops automáticos (L4 — recomendado para empezar)
python main.py run --flow evaluacion --project "/ruta/proyecto"

# CIO autónomo decide todo (L5)
python main.py orchestrate --project "/ruta/proyecto"
4
Ver resultados
python main.py status --project "/ruta/proyecto"

Muestra el MAP.md — índice automático de todos los entregables generados.


📶 Los 5 Niveles

El sistema escala desde uso manual hasta orquestación autónoma. Puedes entrar en cualquier nivel.

Nivel 1
Manual
Copias un SKILL.md a Claude.ai y haces prompting directo. Sin código ni CLI.
Carga SKILL.md → escribe en Claude.ai
Nivel 2
Self-Reflection
Un agente genera su entregable, lo critica con score 1-10 y lo mejora hasta alcanzar el umbral.
python main.py reflect --agent …
Nivel 3
Peer Review
Agente A genera, Agente B revisa desde su dominio, A corrige. Ciclo hasta aprobación.
python main.py review --author … --reviewer …
Nivel 4
Flujos + Debate
Flows predefinidos con loops en pasos críticos. Debate estructurado para decisiones binarias.
python main.py run --flow evaluacion …
Nivel 5
CIO Autónomo ✨
Claude Opus decide qué agentes invocar, en qué orden, en paralelo, con loops y compuertas. 6 tools.
python main.py orchestrate --project …

🔄 Los 3 Flujos

Secuencias predefinidas de agentes que acumulan contexto entre pasos. Los loops se activan automáticamente.

🔍 Evaluación
⚙️ Implementación
🚀 GTM

¿La idea tiene potencial? — 8 agentes, 7 documentos + compuerta GO/NO-GO

3 loops activos

python main.py run --flow evaluacion --project "/ruta/proyecto"
1
Business Strategist
→ ESTRATEGIA.md · FODA, modelo de negocio, GO/NO-GO
↻ Self-reflect score ≥ 8/10, máx 3 iter.
2
B2C/B2B Analyst
→ ANALISIS_MERCADO.md · Segmentos, ICP, canales
3
Customer Discovery
→ CUSTOMER_DISCOVERY.md · Hipótesis, Mom Test, PMF
4
Market Size
→ TAMAÑO_MERCADO.md · TAM / SAM / SOM, beachhead
5
Value Proposition
→ PROPUESTA_VALOR.md · VP Canvas, diferenciadores, taglines
↻ Self-reflect score ≥ 8/10, máx 3 iter.
6
Competitive Intelligence
→ COMPETENCIA.md · Mapa competitivo, Blue Ocean, moat
7
Financial Advisor
→ MODELO_FINANCIERO_INICIAL.md · Unit economics, P&L, runway
👥 Peer review revisor: Risk & Process Auditor, score ≥ 8/10
8
PM — Compuerta 1
→ COMPUERTA_1.md · APROBADO / RECHAZADO con feedback

¿Cómo se construye? — 7 agentes, 6 documentos técnicos + compuerta

1 loop activo

python main.py run --flow implementacion --project "/ruta/proyecto"
1
Product Strategist
→ PRD.md · MoSCoW, User Stories, North Star
2
Business Analyst
→ CASOS_DE_USO.md · Flujos, reglas de negocio, permisos
3
Tech Lead
→ ARQUITECTURA.md · ADRs, stack, data model, cost estimate
↻ Self-reflect score ≥ 8/10, máx 3 iter.
4
Fullstack Developer
→ GUIA_DESARROLLO.md · Setup, patrones, features críticos
5
DevOps / QA
→ PIPELINE_CICD.md · CI/CD, ambientes, SLOs, rollback
6
Cybersecurity
→ SECURITY_REVIEW.md · STRIDE, checklist 20+ ítems, compliance
7
PM — Compuerta 2
→ COMPUERTA_2.md · Decisión técnica con presupuesto y riesgos

¿Cómo se vende? — 6 agentes, 5 documentos de marketing + compuerta

1 loop activo

python main.py run --flow gtm --project "/ruta/proyecto"
1
Brand Strategist
→ BRAND_MANUAL.md · Positioning, voz y tono, naming
↻ Self-reflect score ≥ 8/10, máx 3 iter.
2
UX Director
→ UX_GUIDELINES.md · Principios, journey map, wireframes
3
Copywriter
→ COPY_DECK.md · Headlines, landing, emails, ads, pitch
4
Growth Hacker
→ GTM_STRATEGY.md · Motion PLG/SLG, canales, funnel
5
VP Growth
→ GROWTH_ROADMAP.md · North Star, hitos, retención
6
PM — Compuerta 4
→ COMPUERTA_4.md · ¿Listo para salir al mercado?

↻ Loops de Mejora Iterativa

Los loops operan dentro de cada entregable antes de que el siguiente agente lo reciba. Se activan automáticamente en los flows o de forma independiente.

🔄
Self-Reflection L2+
Genera → critica con score 1-10 → mejora → repite hasta score ≥ umbral o máx iteraciones.
Agentes recomendados: business-strategist, tech-lead, brand-strategist, value-proposition
👥
Peer Review L3+
A genera → B revisa desde su dominio → A corrige → B re-evalúa → ciclo hasta aprobación.
Par estrella: financial-advisor ← revisado por → risk-process-auditor
⚔️
Debate L4+
Proponente y Desafiante argumentan N rondas → convergencia → Claude Opus sintetiza en DEBATE_SUMMARY.md.
Para decisiones binarias: GO/NO-GO, freemium vs. paid, build vs. buy

Comandos directos

python main.py reflect --agent business-strategist \
  --task "Genera ESTRATEGIA.md basado en el BRIEF." \
  --project "/ruta/proyecto" --score-threshold 8 --max-iterations 3

python main.py review --author financial-advisor \
  --reviewer risk-process-auditor \
  --task "Genera el modelo financiero con unit economics." \
  --project "/ruta/proyecto"

python main.py debate --agent-a business-strategist \
  --agent-b risk-process-auditor \
  --topic "¿El modelo freemium es viable con USD 30k?" \
  --project "/ruta/proyecto" --max-rounds 4

🧠 Nivel 5 — CIO Autónomo

El CIO es Claude Opus recibiendo el BRIEF y decidiendo autónomamente la estrategia completa. No hay secuencia fija — el LLM elige herramientas, cuándo y con qué argumentos. El código solo ejecuta las decisiones del modelo.

python main.py orchestrate --project "/ruta/proyecto"
python main.py orchestrate --project "/ruta/proyecto" --max-rounds 20

Las 6 herramientas del CIO

invoke_specialist
Invoca cualquiera de los 56 agentes. Con parallel_group corre varios simultáneamente via asyncio.gather().
evaluate_gate
El PM evalúa entregables: APROBADO / RECHAZADO. Si rechaza, re-invoca automáticamente a los agentes que deben corregir.
generate_contract
Genera el contrato I/O entre dos agentes antes de que el receptor empiece. Formaliza dependencias.
self_reflect
Activa auto-reflexión en cualquier agente cuando el CIO detecta riesgo de baja calidad estratégica.
peer_review
El CIO orquesta peer review eligiendo el autor y revisor más apropiados para el contexto.
debate
Activa debate para decisiones binarias importantes. Recibe la síntesis y la usa para continuar.
⚠️ Costo: El Nivel 5 usa Claude Opus y puede invocar docenas de agentes + loops. Para explorar, usa --flow evaluacion (Nivel 4) que cuesta significativamente menos.

👤 Los 50 Agentes

Meta
Orquestación
Business
Tech
Marketing
Finanzas / Otros
AgenteCuándoRuta
conciergeInicio de cualquier proyecto — genera BRIEF y PLAN_INICIAL00-meta/concierge
contract-generatorFormalizar I/O entre cualquier par de agentes00-meta/contract-generator
system-dashboardMedir rendimiento del sistema (8 KPIs)00-meta/system-dashboard
AgenteRolRuta
CIOOrquestador global — Level 5, tool_use, decisiones autónomas01-orquestacion/cio
PMCompuertas de fase, evaluación de entregables, retroalimentación01-orquestacion/pm
AgenteEspecialidad
business-strategistAnálisis estratégico, FODA, modelos de negocio, GO/NO-GO
b2c-analystMercado B2C, segmentación, personas, canales de adquisición
b2b-salesSales enterprise, pipeline B2B, ciclos de venta largos
financial-advisorUnit economics, P&L, CAC/LTV, proyecciones financieras
risk-process-auditorAuditoría de riesgos, supuestos optimistas, procesos de control
customer-discoveryMom Test, hipótesis de problema, experimentos de validación
market-size-priorityTAM/SAM/SOM, beachhead, proyecciones de mercado
value-propositionValue Prop Canvas, diferenciadores, taglines
competitive-intelligence-positioningAnálisis de competidores, Blue Ocean, ventaja sostenible
pipeline-leads-sales-successGeneración de leads, pipeline comercial, CS post-venta
corporate-scoutM&A, partnerships, oportunidades de inversión estratégica
legal-complianceContratos, regulaciones, propiedad intelectual
procurement-complianceProcesos de compra, evaluación de proveedores
customer-successOnboarding, retención, churn, NPS, expansión
revopsRevenue Operations, alineación ventas-marketing-CS
AgenteEspecialidad
product-strategistPRD, MoSCoW, North Star Metric, roadmap
business-analystCasos de uso, reglas de negocio, Gherkin
scrum-masterCeremonias Scrum, velocidad del equipo, sprints
board-secretaryActas de reunión, decisiones formales, gobierno
tech-leadArquitectura, ADRs, stack decisions, trade-offs
principal-software-engineerPatrones de diseño, code review de alto nivel
fullstackImplementación web full-stack, guías de desarrollo
mobileiOS Swift, Android Kotlin, React Native
devops-qaCI/CD, Docker, cloud, ambientes, SLOs
qa-testingTest plans, automatización, BDD/Gherkin
cybersecuritySTRIDE, threat model, OWASP, compliance
data-analyticsAnalytics plan, KPIs, dashboards, pipelines
quantitative-data-scientistModelos estadísticos, A/B testing, forecasting
applied-ia-iotML, LLMs, IoT, integración de IA en productos
AgenteEspecialidad
brand-strategistPositioning, personalidad de marca, voz y tono, naming
ux-directorUX principles, journey maps, wireframes, métricas
copywriterHeadlines, landing pages, emails, ads, pitch
growth-hackerGTM motion, canales de adquisición, experimentos
web-presentationEstructura web, copy, SEO, conversión
tactical-ux-analystAnálisis de usabilidad, heat maps, CRO
AgenteEspecialidad
vp-financial-engineeringModelado financiero avanzado, fundraising, valuation
vp-growthNorth Star, growth model, retención, expansión
cost-controllerControl de costos, presupuesto operativo
change-managementGestión del cambio organizacional, adopción tecnológica
knowledge-baseProcesa documentación externa, resume para el sistema

💻 CLI Completo

Todos los comandos desde runtime/. El flag --project acepta rutas absolutas, ~/ruta o nombres cortos (busca en runtime/projects/).

ComandoQué haceNivel
python main.py newCrear proyecto — pregunta nombre y carpeta destinoL1+
python main.py run --flow <nombre>Flow completo: evaluacion / implementacion / gtmL4
python main.py orchestrateCIO autónomo con tool_useL5
python main.py reflectSelf-reflection en un agenteL2
python main.py reviewPeer review entre dos agentesL3
python main.py debateDebate estructurado → DEBATE_SUMMARY.mdL4
python main.py agent --path <ruta>Un agente individual con input directoL1+
python main.py statusVer MAP.md del proyecto—
python main.py agentsListar los 56 agentes disponibles—
python main.py contractGenerar contrato I/O entre dos agentes—

Scripts de ejemplo (FitRoutine)

python ejemplos/ejemplo_self_reflection.py   # ~$0.08–$0.20
python ejemplos/ejemplo_peer_review.py       # ~$0.15–$0.35
python ejemplos/ejemplo_debate.py            # ~$0.25–$0.60

📁 Estructura

Skills - Business & AI/
├── MANUAL_DE_USO.md         ← manual completo
├── SISTEMA_MULTIAGENTE.html ← esta guía (web)
├── agents/                  ← 56 agentes (4 capas)
│   ├── 00-meta/             concierge, contract-generator, dashboard
│   ├── 01-orquestacion/     cio, pm
│   ├── 02-equipos/          3 equipos de flujo completo
│   └── 03-especialistas/    47 expertos individuales
└── runtime/                 ← motor de ejecución
    ├── main.py              CLI principal
    ├── .env                 ANTHROPIC_API_KEY=sk-ant-...
    ├── engine/              agent_runner, flow_engine, kb_agent
    ├── orchestrator/        cio_orchestrator (Level 5)
    ├── flows/               evaluacion, implementacion, gtm
    ├── loops/               self_reflection, peer_review, debate
    └── ejemplos/            scripts demo con FitRoutine
Los flows son reanudables. Si el proceso se interrumpe, vuelve a correr el mismo comando — detecta los archivos ya existentes y retoma desde donde se quedó.