Sist oppdatert: 2026-08-09

AI-benchmark på norsk: dagens beste modeller

Over 350 AI-modeller evalueres hver morgen — de beste på norsk språkkvalitet, hastighet og verdi presenteres her.

Les ukesrapporter → Sammenlign modeller → ChatGPT vs Claude → Gemini vs ChatGPT →

Slik leser du benchmarken

Benchmarken er laget for praktiske valg, ikke bare rangering. Se først på oppgaven din, deretter på språk, pris, fart og stabilitet.

Skal du skrive eller jobbe på norsk?

Start med språk-score og hvilkenAI-score. Høy totalscore er nyttig, men språk-kvalitet bør veie tyngst når svaret skal publiseres eller sendes videre.

Skal du bruke AI ofte eller via API?

Se på pris per million tokens og verdi-score. En rimelig modell kan være best når du kjører mange oppgaver eller bygger produkt.

Trenger du raske svar?

Se på tokens per sekund og stabilitet. Rask modell gir bedre flyt i chat, kundeservice, automasjoner og verktøy der ventetid merkes.

Beste i sin klasse

🏆
Høyest score
Cohere: Command R+ (08-2024)
8.4/10
🇳🇴
Best på norsk
Meta: Llama 3.2 1B Instruct
9.3/10
Raskest
Meta: Llama 3.2 1B Instruct
437 t/s
💰
Billigst (score ≥ 3)
Mistral: Mistral Nemo
$0.02/1M
📊
Beste verdi
IBM: Granite 4.0 Micro
Verdi 311.0
🔗
Beste orkestrator
Cohere: Command R+ (08-2024)
Orch 9.3/10

Er premium verdt det?

Premium norsk-score
8.8/10
Mid-range norsk-score
8.6/10
Prisforskjell
~7×

For norsk tekst og enkle oppgaver holder mid-range svært godt. Premium lønner seg ved kompleks resonnering, lange dokumenter og når presisjon er kritisk.

Alle resultater

# Modell Tier t/s TTFT norsk Instr Score Orch. Verdi EU Pris/1M
1
Cohere: Command R+ (08-2024)
cohere
Stabil
Premium 223 107 ms 9.3 10.0 8.4 9.3 3.9 $2.50
≈24 kr
2
Perplexity: Sonar Pro
perplexity
Stabil
Premium 74 199 ms 9.3 10.0 8.1 9.3 3.2 ~EU $3.00
≈29 kr
3
Meta: Llama 3.2 1B Instruct
meta-llama
Stabil
Budsjett 437 34 ms 9.3 8.7 6.1 8.1 225.0 $0.03
≈0 kr
4
Claude Opus 5 (Fast)
anthropic
Stabil
Premium 256 82 ms 9.0 8.7 8.0 7.8 0.9 🇪🇺 EU $10.00
≈95 kr
5
IBM: Granite 4.0 Micro
ibm-granite
Stabil
Budsjett 299 72 ms 8.7 10.0 6.7 8.7 311.0 $0.02
≈0 kr
6
Meta: Llama 4 Maverick
meta-llama
Stabil
Mid-range 141 130 ms 8.7 10.0 7.6 8.7 44.4 $0.20
≈2 kr
7
Anthropic: Claude Haiku 4.5
anthropic
Stabil
Mid-range 134 120 ms 8.7 10.0 7.6 8.7 9.2 🇪🇺 EU $1.00
≈10 kr
8
Mistral Large 2407
mistralai
Mid-range 265 90 ms 8.7 9.3 7.8 8.1 4.5 🇪🇺 EU $2.00
≈19 kr
9
Cohere: Command R7B (12-2024)
cohere
Budsjett 408 43 ms 8.3 10.0 6.5 8.3 183.4 $0.04
≈0 kr
10
Google: Gemini 3.5 Flash Lite
google
Stabil
Mid-range 213 63 ms 8.3 9.3 7.2 7.8 28.5 ~EU $0.30
≈3 kr
11
OpenAI: GPT-5.4 Image 2
openai
Premium 158 91 ms 7.7 9.3 6.7 7.2 1.1 $8.00
≈76 kr
12
Mistral: Mistral Nemo
mistralai
Budsjett 156 225 ms 7.3 8.0 5.6 5.9 255.7 🇪🇺 EU $0.02
≈0 kr

Responstid siste 14 dager

Slik tester vi

Vi evaluerer over 350 AI-modeller og presenterer de beste resultatene hver morgen. Scoren kombinerer språkforståelse, kvalitet, hastighet, pris og stabilitet. Den nøyaktige vektingen er proprietær.

Les mer om metodikken →

Vanlige spørsmål

Vi evaluerer over 350 tilgjengelige modeller og presenterer de beste resultatene fra siste benchmark. Utvalget oppdateres dynamisk når markedet endrer seg.

Språk-scoren viser hvor godt modellen leverer svar på riktig språk og med god språkkvalitet. Scoren vises som et normalisert tall.

Instruksjons-scoren viser hvor godt modellen følger oppgaven den får. Vi viser resultatet som en enkel, normalisert score.

Scoren kombinerer språkforståelse, kvalitet, hastighet, pris og stabilitet. Den nøyaktige vektingen er proprietær.

Beste verdi peker på modeller som gir sterke resultater i forhold til pris. Den nøyaktige beregningen er proprietær.