API-referanse

Base URL: https://models.blixai.com/v1 — OpenAI-kompatibelt Chat Completions-API.

Endepunkter

MetodeStiBeskrivelse
POST /v1/chat/completions Generer et svar fra en modell gitt en meldingsliste.
GET /v1/models List tilgjengelige modeller med kontekstlengder.

Chat Completions

POSThttps://models.blixai.com/v1/chat/completions

Krever autentisering med Bearer-nøkkel. Innholdstype: application/json.

Request-parametere

ParameterTypeKravBeskrivelse
modelstringPåkrevdModell-ID, se modellkatalogen. Eksempel: Qwen/Qwen3.8-Flash-Next-FP8.
messagesarrayPåkrevdSamtaelogg med objekter som har role (system, user, assistant, tool) og content.
max_tokensintegerValgfrittMaks antall tokens i svaret. Merk: for resonnerende modeller medgår resonneringstokens også her — sett gjerne 1024+.
temperaturenumberValgfrittSlumpmessighet, 0–2. Standard 1.
top_pnumberValgfrittKjerneprøveuttak, 0–1.
streambooleanValgfritttrue gir svaret som SSE-strøm. Se Strømming.
toolsarrayValgfrittFunksjonsdefinisjoner for tool calling. Se Tool calling.
stopstring/arrayValgfrittStoppstrenger som avslutter genereringen.
nintegerValgfrittAntall valg å generere.

Eksempel: grundig forespørsel

cURL
curl https://models.blixai.com/v1/chat/completions \
  -H "Authorization: Bearer $BLIXAI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "GLM-5.3-FP4",
    "messages": [
      {"role": "system", "content": "Du er en presis assistent."},
      {"role": "user", "content": "Forklar begrepet token i tre punkter."}
    ],
    "max_tokens": 512,
    "temperature": 0.7
  }'

Svarformat

JSON
{
  "id": "chatcmpl-b430cd33-0bf5-499b-a523-6902f7cfec29",
  "object": "chat.completion",
  "created": 1789835011,
  "model": "Qwen/Qwen3.8-Flash-Next-FP8",
  "choices": [
    {
      "index": 0,
      "message": {
        "role": "assistant",
        "content": "1. Et token er ...",
        "reasoning": "Brukeren ber om en forklaring ..."
      },
      "finish_reason": "stop"
    }
  ],
  "usage": {
    "prompt_tokens": 60,
    "completion_tokens": 48,
    "total_tokens": 108,
    "prompt_tokens_details": { "cached_tokens": 0 },
    "completion_tokens_details": { "reasoning_tokens": 22 }
  }
}

Resonnerende modeller: Qwen- og GLM-modellene våre bruker et ekstra reasoning-felt med modellens tanker. content kan være null mens resonneringen pågår, og finish_reason blir "length" hvis max_tokens blir brukt opp under resonneringen. Resonneringstokens telles i usage.completion_tokens_details.reasoning_tokens.

finish_reason

VerdiBetydning
stopModellen ble ferdig naturlig eller traff en stoppstreng.
lengthmax_tokens ble nådd. Svar kan være ufullstendig — øk grensen.
tool_callsModellen ønsker å kalle ett eller flere verktøy. Se nedenfor.

Strømming (SSE)

Sett "stream": true for å få svart token for token som Server-Sent Events:

cURL
curl -N https://models.blixai.com/v1/chat/completions \
  -H "Authorization: Bearer $BLIXAI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "Qwen/Qwen3.8-Flash-Next-FP8",
    "messages": [{"role": "user", "content": "Fortell en kort historie"}],
    "stream": true
  }'

Hver rad er en JSON-chunk med object: "chat.completion.chunk". Innholdet kommer gradvis i choices[0].delta. Hos resonnerende modeller kommer delta.reasoning først, deretter delta.content:

SSE
data: {"id":"chatcmpl-54d9699a-...","object":"chat.completion.chunk",
  "choices":[{"index":0,"delta":{"reasoning":"We"},"finish_reason":null}]}

data: {"id":"chatcmpl-54d9699a-...","object":"chat.completion.chunk",
  "choices":[{"index":0,"delta":{"content":"Det"},"finish_reason":null}]}

data: {"id":"chatcmpl-54d9699a-...","object":"chat.completion.chunk",
  "choices":[{"index":0,"delta":{},"finish_reason":"stop"}]}

data: [DONE]

Hvis du ikke er interessert i resonneringsteksten, kan du trygt ignorere delta.reasoning og kun hente ut delta.content.

Tool calling

Send en tools-liste med funksjonsdefinisjoner (OpenAI-format). Når modellen ønsker å bruke et verktøy, kommer finish_reason: "tool_calls" og message.tool_calls med funksjonsnavn og argumenter:

cURL
curl https://models.blixai.com/v1/chat/completions \
  -H "Authorization: Bearer $BLIXAI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "GLM-5.3-FP4",
    "messages": [{"role": "user", "content": "Hva er klokka?"}],
    "tools": [{
      "type": "function",
      "function": {
        "name": "get_time",
        "description": "Hent gjeldende klokkeslett",
        "parameters": {"type": "object", "properties": {}}
      }
    }]
  }'
JSON — utdrag
{
  "choices": [{
    "message": {
      "role": "assistant",
      "content": null,
      "tool_calls": [{
        "id": "chatcmpl-tool-a61896ccfd47c82e",
        "type": "function",
        "function": { "name": "get_time", "arguments": "{}" }
      }]
    },
    "finish_reason": "tool_calls"
  }]
}

Utfør funksjonskallet i koden din og send svaret tilbake som en melding med role: "tool" og samme tool_call_id. Deretter fortsetter samtalen som vanlig.

Modellendepunktet

GEThttps://models.blixai.com/v1/models

JSON
{
  "object": "list",
  "data": [
    {
      "id": "GLM-5.3-FP4",
      "object": "model",
      "created": 1789481767,
      "owned_by": "Blix AI",
      "max_model_len": 524288,
      "context_length": 524288,
      "max_input_tokens": 524288
    }
  ]
}

Feilhåndtering

Alle feil kommer på samme JSON-format, uavhengig av feilkilde:

JSON
{
  "error": {
    "message": "Melding som forklarer feilen",
    "type": "invalid_request_error",
    "code": "invalid_api_key",
    "param": null
  }
}
HTTP-statusKodeMening
400invalid_request_errorUgyldig forespørsel — manglende eller feil parametere.
401invalid_api_keyAPI-nøkkel mangler eller er ugyldig. Sjekk Authorization-hodet.
404not_foundUkjent endepunkt eller ukjent modell-ID.
429rate_limit_exceededFor mange forespørsler — trap eksponentielt og forsøk igjen.
500/503server_errorMidlertidig problem på serveren — forsøk igjen med backoff.

Sist oppdatert: 19. september 2026