Interaktiva diagram över 595 AI-modeller — hur de presterar på nio utvärderingar, vad de kostar och hur snabbt de svarar. Data från Artificial Analysis, uppdaterad 2026-08-15.
63,1 av 100
59,7 av 100
1 628,7 tokens/s
37,8 index för 0,111 $ per 1M
255 modeller i urvalet
Artificial Analysis sammanvägda index över nio utvärderingar. Högre är bättre.
1.Claude Opus 5 (max)Anthropic
63,12.Claude Opus 5 (xhigh)Anthropic
62,53.Claude Fable 5 (with fallback)Anthropic
62,14.Claude Opus 5 (high)Anthropic
61,55.Grok 4.6 (high)SpaceXAI
60,96.GPT-5.6 Sol (max)OpenAI
60,97.Kimi K3 (max)Kimi
59,78.GPT-5.6 Sol (xhigh)OpenAI
59,09.Claude Opus 5 (medium)Anthropic
58,610.Qwen3.8 MaxAlibaba
58,111.Qwen3.8 2.4T A95BAlibaba
57,712.GPT-5.6 Sol (high)OpenAI
57,313.Muse Spark 1.2 (xhigh)Meta
56,814.GPT-5.6 Terra (max)OpenAI
56,615.Gemini 3.7 Flash (high)Google
56,016.Grok 4.5 (high)SpaceXAI
55,817.GPT-5.6 Sol (medium)OpenAI
55,618.Claude Sonnet 5 (max)Anthropic
55,319.Gemini 3.7 Flash (medium)Google
53,420.DeepSeek V4 Pro 0813 (max)DeepSeek
53,2Skala 0–100
Indexet väger samman GPQA Diamond, Humanity's Last Exam, SciCode, LiveCodeBench, Terminal-Bench, τ²-bench, IFBench, CritPt och MMMU-Pro.
Välj en utvärdering och se vilka modeller som faktiskt leder på just den.
Naturvetenskapliga frågor på forskarnivå.
1.Grok 4.6 (high)SpaceXAI
94,9 %2.Gemini 3.7 Flash (high)Google
94,5 %3.GPT-5.6 Sol (max)OpenAI
94,1 %4.Gemini 3.1 Pro PreviewGoogle
94,1 %5.Claude Opus 5 (xhigh)Anthropic
93,7 %6.Claude Opus 5 (high)Anthropic
93,7 %7.Kimi K3 (max)Kimi
93,5 %8.Qwen3.8 2.4T A95BAlibaba
93,5 %9.Claude Opus 5 (max)Anthropic
93,2 %10.GPT-5.6 Sol (xhigh)OpenAI
93,1 %11.Grok 4.5 (high)SpaceXAI
93,1 %12.MiniMax-M3MiniMax
92,9 %13.GPT-5.6 Sol (high)OpenAI
92,8 %14.DeepSeek V4 Pro 0813 (max)DeepSeek
92,8 %15.Gemini 3.6 FlashGoogle
92,8 %Andel rätt, 0–100 %
Vad kostar en poäng till? Varje punkt är en modell — nere till höger är dyrt och svagt, uppe till vänster är billigt och starkt.
Intelligensindex
Priset är ett blandat pris i USD per miljon tokens (3 delar indata mot 1 del utdata). Logaritmisk skala.
Snabba modeller är sällan de starkaste. Här syns var kompromissen faktiskt ligger.
Intelligensindex
Hastigheten är medianen av utdatatokens per sekund, mätt av Artificial Analysis mot leverantörernas egna API:er.
Varje punkt är en modellrelease. Linjen följer det bästa index som någon modell nått fram till den tidpunkten.
Intelligensindex · linjen visar bästa index hittills
Historiken innehåller även avvecklade modeller, eftersom de visar hur snabbt fronten har flyttats.
En rad per leverantör, med deras bästa modell i urvalet.
1.AnthropicClaude Opus 5 (max)
63,12.SpaceXAIGrok 4.6 (high)
60,93.OpenAIGPT-5.6 Sol (max)
60,94.KimiKimi K3 (max)
59,75.AlibabaQwen3.8 Max
58,16.MetaMuse Spark 1.2 (xhigh)
56,87.GoogleGemini 3.7 Flash (high)
56,08.DeepSeekDeepSeek V4 Pro 0813 (max)
53,29.Z AIGLM-5.2 (max)
52,610.Motif TechnologiesMotif 3
47,411.MiniMaxMiniMax-M3
45,412.XiaomiMiMo-V2.5-Pro
42,913.Thinking MachinesInkling
42,314.TencentHy3
42,215.Nex AGINex-N2-Pro
41,716.UpstageSolar Pro 4
41,617.China MobileJT-4.1 Flash 236B A21B
39,918.Sapiens AIAgnes 2.5 Pro Alpha
39,7Skala 0–100
Hur mycket text modellen kan hålla i huvudet på en gång.
1.Llama 4 ScoutMeta
10M2.Kimi K3 (max)Kimi
1M3.Muse Spark 1.2 (xhigh)Meta
1M4.Kimi K3 (low)Kimi
1M5.Solar Open2 250BUpstage
1M6.Claude Opus 5 (max)Anthropic
1M7.Claude Opus 5 (xhigh)Anthropic
1M8.Claude Fable 5 (with fallback)Anthropic
1M9.Claude Opus 5 (high)Anthropic
1M10.GPT-5.6 Sol (max)OpenAI
1M11.GPT-5.6 Sol (xhigh)OpenAI
1M12.Claude Opus 5 (medium)Anthropic
1M13.Qwen3.8 MaxAlibaba
1M14.GPT-5.6 Sol (high)OpenAI
1M15.GPT-5.6 Terra (max)OpenAI
1MTokens per förfrågan
Median för utdatatokens per sekund.
1.Celeris-1Celeris
1 628,7 t/s2.Mercury 2Inception
1 230,3 t/s3.Ling 3.0 FlashInclusionAI
394,2 t/s4.Gemini 3.5 Flash-LiteGoogle
389 t/s5.Step 3.7 FlashStepFun
380,5 t/s6.LFM2.5-VL-1.6BLiquid AI
348,7 t/s7.LFM2.5-8B-A1BLiquid AI
340,8 t/s8.Gemini 3.7 Flash (high)Google
340,1 t/s9.Nemotron 3 Nano Omni 30B A3BNVIDIA
322,2 t/s10.Nova MicroAmazon
303,7 t/s11.Nemotron 3.5 LightningNVIDIA
301,8 t/s12.Nemotron 3 NanoNVIDIA
281,1 t/s13.Gemini 3.7 Flash (medium)Google
273,6 t/s14.Qwen3.5 Omni FlashAlibaba
268,4 t/s15.Gemini 3.7 Flash (low)Google
253,5 t/sUtdatatokens per sekund
Intelligensindex är inte ett betyg på en modell utan ett medelvärde över nio utvärderingar. Två modeller med samma index kan vara olika bra på just din uppgift — titta därför alltid på den enskilda benchmark som ligger närmast det du gör.
Priser och hastigheter mäts mot leverantörernas egna API:er och rör sig snabbt. En modell som är dyrast i dag kan vara halva priset om ett kvartal. Använd diagrammen för att förstå storleksordningar, inte för att låsa en budget.
Öppna vikter betyder att modellvikterna går att ladda ner och köra själv. Det säger inget om licensen — flera modeller med öppna vikter har villkor som begränsar kommersiell användning.
Alla mätvärden kommer från Artificial Analysis, som kör utvärderingarna oberoende av modelleverantörerna. Vi räknar inte om något — vi visar deras siffror på svenska.