API-referanse
Base URL: https://models.blixai.com/v1 — OpenAI-kompatibelt Chat Completions-API.
Endepunkter
| Metode | Sti | Beskrivelse |
|---|---|---|
| POST | /v1/chat/completions |
Generer et svar fra en modell gitt en meldingsliste. |
| GET | /v1/models |
List tilgjengelige modeller med kontekstlengder. |
Chat Completions
POSThttps://models.blixai.com/v1/chat/completions
Krever autentisering med Bearer-nøkkel. Innholdstype: application/json.
Request-parametere
| Parameter | Type | Krav | Beskrivelse |
|---|---|---|---|
model | string | Påkrevd | Modell-ID, se modellkatalogen. Eksempel: Qwen/Qwen3.8-Flash-Next-FP8. |
messages | array | Påkrevd | Samtaelogg med objekter som har role (system, user, assistant, tool) og content. |
max_tokens | integer | Valgfritt | Maks antall tokens i svaret. Merk: for resonnerende modeller medgår resonneringstokens også her — sett gjerne 1024+. |
temperature | number | Valgfritt | Slumpmessighet, 0–2. Standard 1. |
top_p | number | Valgfritt | Kjerneprøveuttak, 0–1. |
stream | boolean | Valgfritt | true gir svaret som SSE-strøm. Se Strømming. |
tools | array | Valgfritt | Funksjonsdefinisjoner for tool calling. Se Tool calling. |
stop | string/array | Valgfritt | Stoppstrenger som avslutter genereringen. |
n | integer | Valgfritt | Antall valg å generere. |
Eksempel: grundig forespørsel
curl https://models.blixai.com/v1/chat/completions \
-H "Authorization: Bearer $BLIXAI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "GLM-5.3-FP4",
"messages": [
{"role": "system", "content": "Du er en presis assistent."},
{"role": "user", "content": "Forklar begrepet token i tre punkter."}
],
"max_tokens": 512,
"temperature": 0.7
}'
Svarformat
{
"id": "chatcmpl-b430cd33-0bf5-499b-a523-6902f7cfec29",
"object": "chat.completion",
"created": 1789835011,
"model": "Qwen/Qwen3.8-Flash-Next-FP8",
"choices": [
{
"index": 0,
"message": {
"role": "assistant",
"content": "1. Et token er ...",
"reasoning": "Brukeren ber om en forklaring ..."
},
"finish_reason": "stop"
}
],
"usage": {
"prompt_tokens": 60,
"completion_tokens": 48,
"total_tokens": 108,
"prompt_tokens_details": { "cached_tokens": 0 },
"completion_tokens_details": { "reasoning_tokens": 22 }
}
}
Resonnerende modeller: Qwen- og GLM-modellene våre bruker et ekstra reasoning-felt med modellens tanker. content kan være null mens resonneringen pågår, og finish_reason blir "length" hvis max_tokens blir brukt opp under resonneringen. Resonneringstokens telles i usage.completion_tokens_details.reasoning_tokens.
finish_reason
| Verdi | Betydning |
|---|---|
stop | Modellen ble ferdig naturlig eller traff en stoppstreng. |
length | max_tokens ble nådd. Svar kan være ufullstendig — øk grensen. |
tool_calls | Modellen ønsker å kalle ett eller flere verktøy. Se nedenfor. |
Strømming (SSE)
Sett "stream": true for å få svart token for token som Server-Sent Events:
curl -N https://models.blixai.com/v1/chat/completions \
-H "Authorization: Bearer $BLIXAI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "Qwen/Qwen3.8-Flash-Next-FP8",
"messages": [{"role": "user", "content": "Fortell en kort historie"}],
"stream": true
}'
Hver rad er en JSON-chunk med object: "chat.completion.chunk". Innholdet kommer gradvis i choices[0].delta. Hos resonnerende modeller kommer delta.reasoning først, deretter delta.content:
data: {"id":"chatcmpl-54d9699a-...","object":"chat.completion.chunk",
"choices":[{"index":0,"delta":{"reasoning":"We"},"finish_reason":null}]}
data: {"id":"chatcmpl-54d9699a-...","object":"chat.completion.chunk",
"choices":[{"index":0,"delta":{"content":"Det"},"finish_reason":null}]}
data: {"id":"chatcmpl-54d9699a-...","object":"chat.completion.chunk",
"choices":[{"index":0,"delta":{},"finish_reason":"stop"}]}
data: [DONE]
Hvis du ikke er interessert i resonneringsteksten, kan du trygt ignorere delta.reasoning og kun hente ut delta.content.
Tool calling
Send en tools-liste med funksjonsdefinisjoner (OpenAI-format). Når modellen ønsker å bruke et verktøy, kommer finish_reason: "tool_calls" og message.tool_calls med funksjonsnavn og argumenter:
curl https://models.blixai.com/v1/chat/completions \
-H "Authorization: Bearer $BLIXAI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "GLM-5.3-FP4",
"messages": [{"role": "user", "content": "Hva er klokka?"}],
"tools": [{
"type": "function",
"function": {
"name": "get_time",
"description": "Hent gjeldende klokkeslett",
"parameters": {"type": "object", "properties": {}}
}
}]
}'
{
"choices": [{
"message": {
"role": "assistant",
"content": null,
"tool_calls": [{
"id": "chatcmpl-tool-a61896ccfd47c82e",
"type": "function",
"function": { "name": "get_time", "arguments": "{}" }
}]
},
"finish_reason": "tool_calls"
}]
}
Utfør funksjonskallet i koden din og send svaret tilbake som en melding med role: "tool" og samme tool_call_id. Deretter fortsetter samtalen som vanlig.
Modellendepunktet
GEThttps://models.blixai.com/v1/models
{
"object": "list",
"data": [
{
"id": "GLM-5.3-FP4",
"object": "model",
"created": 1789481767,
"owned_by": "Blix AI",
"max_model_len": 524288,
"context_length": 524288,
"max_input_tokens": 524288
}
]
}
Feilhåndtering
Alle feil kommer på samme JSON-format, uavhengig av feilkilde:
{
"error": {
"message": "Melding som forklarer feilen",
"type": "invalid_request_error",
"code": "invalid_api_key",
"param": null
}
}
| HTTP-status | Kode | Mening |
|---|---|---|
400 | invalid_request_error | Ugyldig forespørsel — manglende eller feil parametere. |
401 | invalid_api_key | API-nøkkel mangler eller er ugyldig. Sjekk Authorization-hodet. |
404 | not_found | Ukjent endepunkt eller ukjent modell-ID. |
429 | rate_limit_exceeded | For mange forespørsler — trap eksponentielt og forsøk igjen. |
500/503 | server_error | Midlertidig problem på serveren — forsøk igjen med backoff. |
Sist oppdatert: 19. september 2026