Modeller
Fra lynraske modeller til kraftige resonnerende LLM-er. Bruk nøyaktig denne modell-ID-en i model-feltet.
| Modell-ID | Størrelse | Kontekst | Resonnerer | Egnet til |
|---|---|---|---|---|
Qwen/Qwen3.8-Flash-Next-FP8 |
176B | 216 000 tokens | Ja | Raske, allround-forespørsler. Godt førstevalg for chat og kode. |
deepseek-ai/DeepSeek-V4-Flash-0731 |
304B | 200 000 tokens | Ja | Kraftig mellommodell for kode og resonnering. |
GLM-5.3-FP4 |
391B | 524 288 tokens | Ja | Tunge oppgaver, lange dokumenter, RAG over store tekstmengder. |
Den autoritative oversikten fås alltid fra GET /v1/models, som oppgir gjeldende kontekstlengder per modell. Modellkatalogen utvides fortløpende.
Hent modeller programmatisk
cURL
curl https://models.blixai.com/v1/models \
-H "Authorization: Bearer $BLIXAI_API_KEY"
Resonnerende modeller
Alle modellene i katalogen er resonnerende (reasoning) modeller. De bruker en tenkefase før de svarer:
- Tankeprosessen vises i
reasoning-feltet i svaret (ellerdelta.reasoningved strømming). - Resonneringstokens teller med i
max_tokensog faktureres som utdata-tokens. - Setter du
max_tokensfor lavt, kan svaret bli tomt fordi hele budsjettet går til resonnering. Anbefalt minimum: 1024.
Hurtigråd for valg
- Lave kostnader og høy hastighet →
Qwen/Qwen3.8-Flash-Next-FP8 - Kodegenerering og resonnering →
deepseek-ai/DeepSeek-V4-Flash-0731 - Maks kontekst (512K) og tyngste oppgaver →
GLM-5.3-FP4
Sist oppdatert: 19. september 2026