Quickstart
Van nul naar werkende lokale AI in vijf minuten. Installeer de engine, pull een model, stel je eerste vraag.
Installeer
Clone de repo, maak een Python-omgeving aan en installeer de engine met de extras die je nodig hebt.
[all]-extra installeert server, MCP, document-parsing, billing en voice. Wil je een minimale install, pak dan een kleinere extra zoals [server].Pull een model via Ollama
Soriku routeert prompts naar het model dat het beste scoort op de taak. Er moet minstens één lokaal model beschikbaar zijn voordat hij ergens naartoe kan routeren.
De eerste drie dekken code, reasoning en algemeen gebruik. nomic-embed-text is het standaard embedding-model en blijft permanent geladen omdat het klein is.
Start de server
De chat-UI staat nu op http://localhost:8765. Het OpenAI-compatible endpoint zit op http://localhost:8765/api/v1/chat/completions.
Stel je eerste vraag
Open de UI, type een prompt en Soriku kiest het beste geïnstalleerde model voor de taak. In het antwoord zie je welk model antwoordde en waarom het werd gekozen.
Waar je nu heen kan
- Installatie voor de complete install-matrix (Docker, systeemvereisten, GPU-detectie).
- Smart routing om te begrijpen wat Soriku doet wanneer het routeert.
- Externe provider toevoegen om Claude, OpenAI, Mistral, Groq of Gemini in de routing-pool te krijgen.
- Gebruik met Cursor of VS Code voor de MCP-integratie.