POST /v1/chat/completions
OpenAI-compatible chat. Accepteert het standaard request-schema, geeft de standaard response-vorm terug, voegt `model`-veld toe dat toont waarheen daadwerkelijk geroute is.
POST
/api/v1/chat/completionsStandaard OpenAI-compatible completions met smart routing.
Parameters
| Naam | Type | Verplicht | Beschrijving |
|---|---|---|---|
messages | array | yes | OpenAI-format message-list |
model | string | no | auto om Soriku te laten routeren, of een specifieke model-id |
stream | boolean | no | Stream tokens via SSE |
temperature | number | no | Sampling-temperatuur |
max_tokens | integer | no | Cap op response-lengte |
x_agent_id | string | no | Koppel een agent persona aan deze request |
Voorbeeld
curl -X POST http://localhost:8765/api/v1/chat/completions \
-H "Authorization: Bearer soriku-local" \
-H "Content-Type: application/json" \
-d '{"model":"auto","messages":[{"role":"user","content":"Hallo"}]}'
Response
{
"id": "chatcmpl-...",
"object": "chat.completion",
"model": "qwen2.5-coder:7b",
"choices": [{
"message": {"role": "assistant", "content": "..."},
"finish_reason": "stop"
}]
}