| Claude Opus 5 |
Anthropic |
Lukket flaggskip |
Nyeste toppflaggskip — state-of-the-art resonnering, 2M kontekst, 256K output, avansert agentisk koding og multimodal |
Høyeste kostnadsnivå |
API-tilgang
|
| Claude Fable 5 |
Anthropic |
Lukket kreativ |
Ny kreativ modell for storytelling, innholdsproduksjon og narrativ skriving. 1M kontekst. |
Spesialisert for kreativt arbeid |
API-tilgang
|
| GPT-5.7 |
OpenAI |
Lukket flaggskip |
Nyeste flaggskip — 1,5M kontekst, 256K output, native multimodal (tekst, bilde, lyd, video), 15% forbedret resonnering |
Høyeste kostnadsnivå |
API-tilgang
|
| Gemini 3.6 Pro |
Google |
Lukket flaggskip |
Kraftigste Gemini — 2M tokens kontekst, frontier resonnering, avansert agentisk og sanntids multimodal |
Høyere kostnad enn Flash |
API-tilgang
|
| Llama 4.1 Behemoth |
Meta |
Åpen vekt multimodal |
Oppdatert frontier med 320B aktive / 2.2T totale parametere (MoE). Forbedret flerspråklig støtte. |
Krever svært tung infrastruktur |
Download
|
| Llama 4.1 Maverick |
Meta |
Åpen vekt multimodal |
Forbedret resonnering med 20B aktive / 450B totale (MoE). Bedre balanse mellom ytelse og effektivitet. |
Krever god multi-GPU infrastruktur |
Download
|
| Llama 4.1 Scout |
Meta |
Åpen vekt multimodal |
Effektiv MoE med 20B aktive / 120B totale. Opptil 12M tokens kontekst. Native multimodal. |
MoE-kompleksitet i drift |
Download
|
| DeepSeek V4.1-Pro-DSpark |
DeepSeek |
Åpen/tilgjengelig flaggskip |
Nyeste og største — 950B parametere. Forbedret resonnering og agentkapasitet. State-of-the-art på SWE-bench. |
Krever massiv infrastruktur; compliance-gjennomgang i bedrift |
Download
|
| DeepSeek V4.1-Flash-DSpark |
DeepSeek |
Åpen/tilgjengelig effektiv |
185B parametere. Raskere inferens med høy kvalitet. |
Styringsgjennomgang i bedrift |
Download
|
| Qwen3.8-2.4T-A95B |
Alibaba |
Åpen vekt MoE flaggskip |
Første åpne «Qwen-Max-klasse»-modell. 2,4T totale / 95B aktive (MoE). 262K native kontekst (opptil 1M). GPQA Diamond: 92,6. Apache 2.0. |
Krever massiv infrastruktur; etterlevelsesvurdering kreves i regulerte miljøer |
Download
|
| Qwen3.8-27B |
Alibaba |
Åpen vekt tett visjon |
Tett 27B-modell med native visjon (bilde og video). Hybrid DeltaNet+Attention. 262K kontekst (opptil 1M). SWE-bench Pro: 61,7. Apache 2.0. |
Krever 24GB+ VRAM; etterlevelsesvurdering kreves |
Download
|
| Qwen3.8-Flash-Next |
Alibaba |
Åpen vekt MoE eksperimentell |
Preview av Qwen4-arkitektur. 125B totale / 6B aktive (MoE) med n-gram-embedding og QSA. Matcher 27B med kun 6B aktive. Multimodal. Apache 2.0. |
Eksperimentell; arkitekturen er ny og uprøvd i produksjon |
Download
|
| GPT-5.6 Sol |
OpenAI |
Lukket frontier |
Nyeste flaggskip — komplekst profesjonelt arbeid, 1,05M kontekst, computer use, web/file search |
Høyeste kostnadsnivå |
API-tilgang
|
| GPT-5.6 Terra |
OpenAI |
Lukket balansert |
Balansert kapasitet og kostnad, 1,05M kontekst, computer use |
Lavere enn Sol på de mest krevende oppgavene |
API-tilgang
|
| GPT-5.6 Luna |
OpenAI |
Lukket budsjett |
Budsjettoptimalisert med 1,05M kontekst |
Lavere kvalitet enn Terra/Sol |
API-tilgang
|
| GPT-5.5 |
OpenAI |
Lukket flaggskip |
Nyeste GPT — ny klasse intelligens for koding og profesjonelt arbeid |
Premiumkostnad |
API-tilgang
|
| GPT-5.4 |
OpenAI |
Lukket |
Rimligere alternativ for koding, computer use og subagenter |
Ikke like kapabel som GPT-5.5 på de mest krevende oppgavene |
API-tilgang
|
| GPT-5 |
OpenAI |
Lukket multimodal |
Router-arkitektur: velger automatisk mellom rask og dyp modell. Sterk matematikk, koding og multimodal. |
Variabel kvalitet pga. router; høy kostnad |
API-tilgang
|
| o3 |
OpenAI |
Resonnering-flaggskip |
Avansert resonnering: 87,7 % GPQA Diamond, 71,7 % SWE-bench, 2727 Elo Codeforces |
Høy latens og kostnad; privat tankekjede |
API-tilgang
|
| o4-mini |
OpenAI |
Resonnering-effektiv |
Kostnadseffektiv resonnering for utviklere og tekniske arbeidsflyter |
Lavere tak enn o3 på de mest komplekse oppgavene |
API-tilgang
|
| GPT-4.1 |
OpenAI |
Lukket |
Generell resonnering og koding |
Premiumkostnad |
API-tilgang
|
| GPT-4o |
OpenAI |
Lukket multimodal |
Rask assistentopplevelse og multimodale oppgaver |
Kostnad ved høy skala |
API-tilgang
|
| GPT-4o mini |
OpenAI |
Lukket liten |
Kostnadssensitiv høyvolum-automatisering |
Lavere tak på krevende resonnering |
API-tilgang
|
| o1 |
OpenAI |
Resonnering-først |
Kompleks flertrinnslogikk |
Latenstid og kostnad per krevende forespørsel |
API-tilgang
|
| o3-mini |
OpenAI |
Resonnering-effektiv |
Teknisk spørsmål/svar og kodearbeidsflyter |
Kan kreve prompt-justering |
API-tilgang
|
| Claude Sonnet 5 |
Anthropic |
Lukket balansert |
Ny! Beste kombinasjon av hastighet og intelligens. 1M kontekst, 128K output, $3/$15 per MTok. |
Ikke like kapabel som Opus/Fable på de mest krevende oppgavene |
API-tilgang
|
| Claude Opus 4.8 |
Anthropic |
Lukket flaggskip |
Nyeste og mest kapable Claude. Forbedret koding, resonnering og agentiske oppgaver. Koordinerer hundrevis av parallelle agenter. |
Høyere kostnad og latens enn Sonnet; nytt — begrenset langtidserfaring |
API-tilgang
|
| Claude Opus 4.7 |
Anthropic |
Lukket flaggskip |
Mest kapable Claude-modell for kompleks resonnering, agentisk koding og lange dokumenter |
Høyere kostnad og latens enn Sonnet |
API-tilgang
|
| Claude Sonnet 4.6 |
Anthropic |
Lukket |
Balansert ytelse og hastighet, ideell for de fleste oppgaver |
Ikke like kapabel som Opus på de mest krevende oppgavene |
API-tilgang
|
| Claude Haiku 4.5 |
Anthropic |
Lukket liten |
Rask og kostnadseffektiv for høyvolum og triagering |
Mindre robust på de mest krevende oppgavene |
API-tilgang
|
| Claude 3.7 Sonnet |
Anthropic |
Lukket |
Skriving og analyse med lang kontekst |
Konservativ tone i noen flyter |
API-tilgang
|
| Claude 3.5 Sonnet |
Anthropic |
Lukket |
Balansert kvalitet og stabilitet |
Kostnad ved svært store trafikk-topper |
API-tilgang
|
| Claude 3.5 Haiku |
Anthropic |
Lukket liten |
Raske svar og triagering |
Mindre robust på de mest krevende oppgavene |
API-tilgang
|
| Claude 3 Opus |
Anthropic |
Lukket flaggskip |
Syntese i høy-risiko scenarioer |
Gjennomstrømmingsøkonomi |
API-tilgang
|
| Gemini 3.6 Flash |
Google |
Lukket stabil |
Ny stabil toppmodell. Balanserer hastighet og intelligens for agentiske og multimodale oppgaver. |
Nytt — begrenset langtidserfaring |
API-tilgang
|
| Gemini Deep Research |
Google |
Lukket agent |
Autonom agent som planlegger og utfører flertrinns forskning på tvers av hundrevis av kilder. |
Preview-status; spesialisert bruksområde |
Preview-tilgang
|
| Gemini 3.1 Pro |
Google |
Lukket flaggskip (preview) |
Avansert resonnering, kompleks problemløsning, agentisk koding |
Fortsatt i preview; høyere latens |
Preview-tilgang
|
| Gemini 3.1 Flash-Lite |
Google |
Lukket effektiv |
Frontier-klasse ytelse til brøkdel av kostnad |
Lavere tak enn Pro på komplekse oppgaver |
API-tilgang
|
| Gemini 3.5 Live Translate |
Google |
Lukket oversettelse |
Sanntids tale-til-tale-oversettelse på 70+ språk |
Preview-status |
Preview-tilgang
|
| Gemini Omni Flash |
Google |
Lukket multimodal |
Videogenerering og redigering fra tekst og bilder |
Begrenset tilgang i tidlig fase |
API-tilgang
|
| Gemini 3.5 Flash |
Google |
Lukket agentisk |
Frontier agentisk koding, multimodal forståelse, lange arbeidsflyter |
Nytt — begrenset produksjonserfaring ennå |
API-tilgang
|
| Gemini 3.5 Pro |
Google |
Lukket flaggskip |
Komplekse kreative og analytiske oppgaver |
Ennå ikke tilgjengelig (kommer snart) |
API-tilgang
|
| Gemini Omni |
Google |
Lukket multimodal |
Videogenerering og kreativt multimodalt innhold |
Begrenset tilgang i tidlig fase |
API-tilgang
|
| Gemini 2.0 Pro |
Google |
Lukket |
Resonnering og multimodale bedriftsapper |
Oppgavevariasjon på tvers av prompt-stiler |
API-tilgang
|
| Gemini 2.0 Flash |
Google |
Lukket rask |
Lav-latens assistent-endepunkter |
Lavere kvalitet enn premiumnivå |
API-tilgang
|
| Gemini 1.5 Pro |
Google |
Lukket lang-kontekst |
Arbeidsflyter med svært lange dokumenter |
Pris/ytelse avhenger av belastning |
API-tilgang
|
| Gemini 1.5 Flash |
Google |
Lukket rask |
Effektiv oppsummering og ekstraksjon |
Resonneringsdybde kan være begrenset |
API-tilgang
|
| Llama 4 Behemoth |
Meta |
Åpen vekt multimodal |
Frontierkvalitet med 288B aktive / 2T totale parametere (MoE). Native multimodal. |
Krever svært tung infrastruktur |
Download
|
| Llama 4 Maverick |
Meta |
Åpen vekt multimodal |
Sterk resonnering med 17B aktive / 400B totale (MoE). 1M tokens kontekst. |
Krever god multi-GPU infrastruktur |
Download
|
| Llama 4 Scout |
Meta |
Åpen vekt multimodal |
Effektiv MoE med 17B aktive / 109B totale. Opptil 10M tokens kontekst. Native multimodal. |
MoE-kompleksitet i drift |
Download
|
| Llama 3.1 405B Instruct |
Meta |
Åpen vekt |
Toppnivå kvalitet i åpen utrulling |
Krever tung infrastruktur |
Download
·
70B
·
8B
|
| Llama 3.1 70B Instruct |
Meta |
Åpen vekt |
Sterk balanse mellom kvalitet og kost ved egenhosting |
Krever god inferensstack |
Download
·
405B
·
8B
|
| Llama 3.1 8B Instruct |
Meta |
Åpen vekt liten |
Edge- og lavkost-utrullinger |
Lavere ytelse på komplekse oppgaver |
Download
·
70B
·
405B
|
| Llama 3.2 11B Vision |
Meta |
Åpen multimodal |
Private syn-tekst-pipelines |
Krever evalueringer for OCR-tunge tilfeller |
Download
·
90B
|
| Llama 3.2 90B Vision |
Meta |
Åpen multimodal |
Høykapasitets multimodal inferens |
Infrastrukturkompleksitet |
Download
·
11B
|
| Robostral Navigate |
Mistral AI |
Robotikk-spesialisert |
Navigasjonsmodell for robotikk og embodied AI. Lansert 8. juli 2026. |
Spesialisert — ikke for generell tekstgenerering |
API-tilgang
|
| Leanstral 1.5 |
Mistral AI |
Åpen kildekode |
Lett og tilgjengelig grunnmodell. Åpen kildekode. Lansert 2. juli 2026. |
Lavere kapasitet enn større modeller |
Download
|
| Pixtral Large |
Mistral AI |
Multimodal visjon |
Avansert visjon-språkmodell for bildeforståelse og multimodalt resonnering |
Krever god infrastruktur |
Download
|
| Mistral Small 4 |
Mistral AI |
Åpen MoE (Apache 2.0) |
128 eksperter, 6B aktive / 119B totale. 256K kontekst, multimodal, konfigurerbar resonnering. 40 % lavere latens enn Small 3. |
MoE-kompleksitet; nytt — begrenset produksjonserfaring |
Download
|
| Mistral Large |
Mistral AI |
Lukket |
Høykvalitets bedriftsassistenter |
Mindre økosystem enn hyperskalere |
API-tilgang
|
| Mistral Medium 3.5 |
Mistral AI |
Lukket |
Remote coding-agenter, komplekse oppgaver i Work mode |
Benchmark nøye mot alternativer |
API-tilgang
|
| Mistral Small |
Mistral AI |
Lukket liten |
Rask og kostnadseffektiv chat |
Begrenset dybde i avansert resonnering |
API-tilgang
|
| Mixtral 8x22B |
Mistral AI |
Åpen MoE |
Sterk genereringskvalitet med åpne vekter |
Operasjonell kompleksitet |
Download
·
8x7B
|
| Mixtral 8x7B |
Mistral AI |
Åpen MoE |
Effektiv egenhosting |
Kan ligge bak de nyeste lukkede modellene |
Download
·
8x22B
|
| Voxtral TTS |
Mistral AI |
Tale-spesialisert |
Tekst-til-tale med zero-shot stemmekloning og flerspråklig støtte |
Spesialisert — ikke for generell tekstgenerering |
API-tilgang
|
| Devstral 2 |
Mistral AI |
Kode-spesialisert |
Frontier kodeagent for programvareutvikling og kodereview |
Smalere generell språkstyrke |
API-tilgang
|
| Ministral 3 14B |
Mistral AI |
Åpen kompakt |
Best-in-class tekst og visjon i kompakt størrelse |
Kan ligge bak de nyeste lukkede modellene |
API-tilgang
|
| Ministral 3 8B |
Mistral AI |
Åpen kompakt |
Effektiv tekst og visjon på forbrukermaskinvare |
Lavere tak enn 14B på komplekse oppgaver |
API-tilgang
|
| Ministral 3 3B |
Mistral AI |
Åpen tiny |
Ultra-kompakt med multimodal støtte for edge/mobil |
Svært begrenset på kompleks resonnering |
API-tilgang
|
| Codestral |
Mistral AI |
Kode-spesialisert |
Kodegenerering og fullføring |
Smalere generell språkstyrke |
Download
|
| Gemma 4 31B |
Google |
Åpen vekt |
Mest kapable Gemma for privat resonnering og koding; Apache 2.0-lisensert |
Krever 24GB+ VRAM eller multi-GPU |
Download
·
12B
|
| Gemma 4 12B |
Google |
Åpen vekt balansert |
Ny balansert størrelse mellom 9B og 27B; god ytelse på forbruker-GPU |
Lavere tak enn 31B på komplekse oppgaver |
Download
·
31B
|
| Gemma 4 E4B |
Google |
Åpen vekt mobil |
Optimalisert for mobil og IoT; ~9B med effektiv inferens |
Begrenset på kompleks resonnering |
Download
|
| Gemma 4 E2B |
Google |
Åpen vekt tiny |
Ultra-kompakt for on-device inferens; ~2B parametere |
Svært begrenset resonneringsdybde |
Download
|
| Gemma 4 27B |
Google |
Åpen vekt |
Høykvalitets åpen modell med sterk ytelse i resonnering og koding; Apache 2.0-lisensert |
Krever god inferensinfrastruktur |
Download
·
9B
|
| Gemma 4 9B |
Google |
Åpen vekt liten |
Effektiv åpen modell for edge og offline; godt kompromiss mellom størrelse og kvalitet |
Lavere resonneringsdybde enn 27B |
Download
·
27B
|
| Gemma 2 27B |
Google |
Åpen vekt |
Solid ytelse for åpen utrulling |
Eldre enn Gemma 4 |
Download
·
9B
·
2B
|
| Gemma 2 9B |
Google |
Åpen vekt liten |
Testet og stabil for egenhosting |
Apache 2.0 lisensert - viktig for åpen bruk |
Download
·
27B
|
| Qwen3-ASR |
Alibaba |
Tale-spesialisert |
Automatisk talegjenkjenning med høy nøyaktighet. Tilgjengelig i 0.6B og 1.7B varianter. |
Spesialisert for ASR — ikke generell tekstgenerering |
Download
|
| Qwen3-TTS |
Alibaba |
Tale-spesialisert |
Tekst-til-tale med stemmedesign og stemmekloning. Flerspråklig støtte. |
Spesialisert for TTS — ikke generell tekstgenerering |
Demo
|
| Qwen2.5 72B Instruct |
Alibaba |
Åpen vekt |
Resonnering og flerspråklige oppgaver |
Etterlevelsessjekker for enkelte regioner |
Download
·
32B
·
14B
·
7B
|
| Qwen2.5 32B Instruct |
Alibaba |
Åpen vekt |
Sterk kvalitet med lavere infrastrukturkost |
Prompt-justering er ofte nødvendig |
Download
·
72B
·
14B
·
7B
|
| Qwen2.5 14B Instruct |
Alibaba |
Åpen vekt |
Balansert privat utrulling |
Lavere resonneringsdybde enn større modeller |
Download
·
72B
·
32B
·
7B
|
| Qwen2.5 7B Instruct |
Alibaba |
Åpen vekt liten |
Høy gjennomstrømming med lav kost i inferens |
Lavere resonneringsdybde |
Download
·
14B
·
32B
·
72B
|
| Qwen3.6-27B |
Alibaba |
Åpen vekt |
Tett 27B-modell (ingen MoE) med hybrid tenkemodus og 128K tokens
kontekst. Forutsigbar latens på én GPU — godt alternativ til
35B-A3B der enkelt oppsett prioriteres over råytelse.
|
Lavere toppscore enn 35B-A3B på krevende benchmarks;
etterlevelsesvurdering kreves i regulerte miljøer
|
Download
·
35B-A3B
|
| Qwen3.6-35B-A3B |
Alibaba |
Åpen vekt MoE multimodal |
MoE (35B totalt, 3B aktive); hybrid tenk-modus; 262K tokens
native kontekst (opptil ~1M med YaRN); multimodal (tekst,
bilde, video); agentisk koding på repo-nivå. AIME 2026:
92,7 — SWE-bench: 73,4
|
Etterlevelsesvurdering kreves; tenk-modus øker latens for
enkle oppgaver
|
Download
·
FP8
|
| QwQ-32B |
Alibaba |
Åpen resonnering |
Privat bruk med resonneringsfokus |
Evalueringer kreves for stabilitet |
Download
|
| Qwen3Guard |
Alibaba |
Sikkerhet-spesialisert |
Første sikkerhetsmodell i Qwen-familien. Klassifiserer risikonivå for prompts og svar. Flerspråklig. |
Spesialisert — ikke for generell tekstgenerering |
Download
|
| Qwen-MT |
Alibaba |
Oversettelse-spesialisert |
Oversettelsesmodell basert på Qwen3. 92 språk, dekker 95 % av verdens befolkning. Forsterkningslæring for nøyaktighet. |
Spesialisert for oversettelse; API-basert |
API-tilgang
|
| Qwen-AgentWorld-35B-A3B |
Alibaba |
Åpen vekt agentisk |
Spesialisert for agentisk koding og autonom oppgavegjennomføring. MoE (35B/3B aktive). |
Spesialisert for agentisk bruk |
Download
|
| DeepSeek Janus-Pro-7B |
DeepSeek |
Åpen multimodal |
Multimodal forståelse og generering i én modell. Både bilde-til-tekst og tekst-til-bilde. |
7B kan være begrenset for komplekse oppgaver |
Download
|
| DeepSeek V4-Pro-DSpark |
DeepSeek |
Åpen/tilgjengelig flaggskip |
Nyeste og største — 889B parametere. Forbedret fra V4-Pro med
enda sterkere resonnering og agentkapasitet.
|
Krever massiv infrastruktur; compliance-gjennomgang i bedrift |
Download
|
| DeepSeek V4-Flash-DSpark |
DeepSeek |
Åpen/tilgjengelig effektiv |
165B parametere. Raskere inferens med god kvalitet.
|
Styringsgjennomgang i bedrift |
Download
|
| DeepSeek V4 |
DeepSeek |
Åpen/tilgjengelig (preview) |
Verdensklasse resonnering og betydelig forbedret agent-kapabilitet.
MoE-arkitektur, sterk på koding og matte. Tilgjengelig via web,
app og API.
|
Kinesisk opprinnelse krever compliance-gjennomgang i regulerte bedriftsmiljøer. Preview-status. |
Download
|
| DeepSeek V3 |
DeepSeek |
Åpen/tilgjengelig |
God verdi for generell resonnering og koding |
Styringsgjennomgang i bedrift |
Download
|
| DeepSeek R1 |
DeepSeek |
Resonneringsfokusert |
Krevende flertrinns resonneringsoppgaver |
Latenstid på komplekse svar |
Download
|
| DeepSeek Coder V2 |
DeepSeek |
Kode-spesialisert |
Utviklerassistenter og kodegjennomgang |
Generell skriving er mindre sterk |
Download
|
| Kimi K3 |
Moonshot AI |
Åpen vekt MoE flaggskip |
Verdens første åpne 3T-klasse modell. 2,8T totale / 104B aktive (MoE). 1M kontekst. Multimodal (tekst, bilde). GPQA Diamond: 93,5. Sterk agentisk koding. |
Egen lisens; krever massiv infrastruktur; compliance-gjennomgang i bedrift |
Download
|
| GLM-5.3 |
Z.ai |
Åpen vekt MoE |
753B MoE. State-of-the-art på koding og cybersikkerhet blant åpne modeller. 50 % forbedring over GLM-5.2. 1M kontekst. |
Egen lisens; compliance-gjennomgang i bedrift; kinesisk opprinnelse |
Download
|
| GLM-5.3-Flash |
Z.ai |
Åpen vekt MoE effektiv |
321B MoE. Raskere inferens enn GLM-5.3 med god kvalitet. Effektiv for koding og generelle oppgaver. |
Egen lisens; compliance-gjennomgang i bedrift |
Download
|
| Command R+ |
Cohere |
Lukket bedrift |
RAG og bruk av bedriftskunnskap |
Sammenlign mot ledende generelle modeller |
API-tilgang
|
| Command R |
Cohere |
Lukket |
Raske svar forankret i gjenfinning |
Ikke alltid best for dyp koding |
API-tilgang
|
| DBRX Instruct |
Databricks |
Åpen vekt |
Arbeidslaster integrert med dataplattform |
Krever moden plattform |
Download
|
| Fara-1.5 27B |
Microsoft |
Åpen multimodal |
Nyeste Microsoft-modell. Visjon-språk med 27B parametere. Erstatter Phi-serien. |
Ny serie med begrenset produksjonserfaring |
Download
·
9B
·
4B
|
| Fara 7B |
Microsoft |
Åpen multimodal |
Kompakt visjon-språkmodell med 8B parametere for effektive multimodale oppgaver. |
Begrenset på komplekse oppgaver sammenlignet med større modeller |
Download
|
| Phi-3 Medium |
Microsoft |
Liten modell |
Kompakte utrullinger og edge-bruk |
Begrenset på svært komplekse oppgaver |
Download
·
Mini
|
| Phi-3 Mini |
Microsoft |
Liten modell |
Inference på enhet og i begrensede miljøer |
Lavere nøyaktighetstak |
Download
·
Medium
|
| Yi-34B Chat |
01.AI |
Åpen vekt |
Flerspråklig eksperimentering |
Krever grundig evaluering før produksjon |
Download
|
| nb-gpt-gemma4 e4b |
NbAiLab |
Norsk åpen |
Nyeste norske modellserie basert på Gemma 4 med instruksjons- og SFT-varianter. Aktiv utvikling. |
Under kontinuerlig utvikling, sjekk siste versjon |
Download
|
| NorMistral-11B-thinking |
NORA.LLM |
Norsk åpen |
Reasoning-variant med styrket resonnering for norsk. GGUF-distribusjon for lokal kjøring. |
Trenger god GPU for full ytelse |
Download
|
| NorMistral-7B-warm |
NORA.LLM |
Norsk åpen |
Praktisk norsk modell for produksjon og eksperimentering. Trent på store norske korpus. |
Mindre enn 11B-varianten |
Download
|
| TranslateGemma 4B |
NbAiLab |
Norsk oversettelse |
Spesialisert oversettelsesmodell for bokmål ↔ nynorsk. Kan kjøres på forbrukerhardware. |
Kun oversettelse, ikke generell chat |
Download
|
| NB-Llama-3.2 3B |
NbAiLab |
Norsk åpen liten |
Optimalisert for norsk i kompakt format. God for chatbot og klassifisering. |
Begrenset generell resonnering vs større modeller |
Download
|
| Viking 33B |
AI Sweden |
Nordisk åpen |
Flerspråklig nordisk modell med sterk norsk, svensk, dansk og finsk støtte. |
Nordisk fokus, kan mangle bredde på andre språk |
Download
|
| Borealis (270M–27B) |
NbAiLab |
Gemma |
Komplett norsk modellfamilie bygget på Gemma 3. Multimodal fra 4B+. GGUF, MLX, safetensors. |
Instruksjons-preview, åpne base-modeller tilgjengelig |
Download
|
| NB-Whisper (39M–1.5B) |
NbAiLab |
CC BY 4.0 |
Norsk talegjenkjenning trent på 20 000 timer tale fra NRK, Stortinget og Nasjonalbiblioteket. |
Beta. Tiny til Large. Støtter bokmål, nynorsk og engelsk. |
Download
|
| hviske-v5-tiny (263M) |
syv.ai |
CC BY-NC 4.0 |
Dansk ASR distillert fra 2.1B ensemble. 320× sanntid, kjører i nettleser via WebGPU. |
Slår større modeller på FTSpeech. Også v5.3 (2B) tilgjengelig. |
Download
|