docs / concepts / plan-mode

Plan mode

Multi-worker orchestratie voor grote taken. De Conductor plant, Workers voeren parallel uit, en een synthese-stap combineert de resultaten tot één antwoord met herkomst.

Wanneer je het wil

Gebruik plan mode wanneer de taak te groot is voor een enkel model in een enkele pass: "audit deze codebase op security issues", "ontwerp en scaffold een nieuwe feature end-to-end", "review deze architectuur en stel alternatieven voor". De Conductor ziet het hele doel, de Workers zien alleen hun stuk.

De pipeline

  1. Conductor ontvangt het doel, genereert een plan als een directed acyclic graph van taken. Elke taak heeft een rol, een doel, dependencies en een tool-allowlist.
  2. Workers pakken hun taken op. Elke Worker is een agent persona gematcht aan de task-rol (backend-developer, code-reviewer, devops-engineer, etc.). Taken zonder dependencies draaien parallel.
  3. Synthese combineert de WorkerResults. Strategieën: merge (concatenate met sectionheaders), consensus (stem over betwiste punten), select_best (kies het sterkste antwoord).
  4. Final answer komt terug met volledige herkomst: welke Worker deed wat, welk model elk gebruikte, en hoe lang elke stap duurde.

Worker-rollen

Workers zijn getypeerd op rol. Elke rol heeft een capability-profiel, een tool-allowlist en een default system prompt.

Roldefinities staan in config/worker_roles.yaml. Daar kan je rollen toevoegen of overschrijven.

Kostenbalans

Plan mode draait meerdere modellen, wat meer kost dan een enkele completion. De Conductor schat de totaalkosten voor dispatch en kan per request gecapped worden. Je kan plan mode ook op local_only pinnen, dan gebruikt hij alleen Ollama-modellen en kost het niks aan API-fees.

Spaarzaam gebruiken
Plan mode is krachtig maar niet gratis. Gebruik het voor security reviews, architectuurkeuzes en alles waar de kosten van fout zijn hoger zijn dan de kosten van drie modellen parallel draaien. Voor de rest is single-model routing sneller en goedkoper.

API reference: worker endpoint →