hintavertailu.com · ai-api

LLM-API: hinta per miljoona tokenia

Kielimallit laskuttavat tokeneittain: erikseen syöte (input, kehote + konteksti) ja tuotos (output, mallin vastaus). Tuotos on tyypillisesti 2–5× syötettä kalliimpi. Vertailemme lippulaiva- ja edullisia malleja. Suljetut (OpenAI, Anthropic, Mistral) vs. avoimien mallien isännöijät (Groq, Together, Fireworks, DeepSeek) — joilla sama avomalli voi maksaa hyvin eri verran.

Hinnat tarkistettu 14.7.2026 · tarkistettu käsin mallia
Säädä kuukausikäyttö liukusäätimillä — $/kk-sarake laskee kustannuksen (input Mtok × input $/1M + output Mtok × output $/1M) · järjestä napsauttamalla otsikkoa · palkki = yhteishinta (1M input + 1M output)
5 Mtok/kk
2 Mtok/kk

Palvelu $/kk valitulla käytöllä Malli Tyyppi Taso Älykkyys (AA) Input $/1M Output $/1M Yhteensä (1M+1M) Huomiot
MistralHalvin
$1,10
Mistral SmallSuljettuKevyt$0,10$0,30
$0,40
Halpa eurooppalainen malli; tarkista tarkka luku docs.mistral.ai · AA v4.1: ei tarkkaa versiota (Small vanha ≈ 5)
DeepSeekParas hinta-laatu
$1,26
DeepSeek V4 FlashAvoin (isännöity)Keskitaso
40
$0,14$0,28
$0,42
Halvin; virallinen API-hinnasto; deepseek-chat/reasoner vanhenevat 24.7.2026 · AA v4.1: 40 (reasoning)
OpenAI
$3,50
GPT-5.4 nanoSuljettuKevyt
38
$0,20$1,25
$1,45
Halvin OpenAI-taso; virallinen hinnasto · AA v4.1: 38 (reasoning xhigh)
DeepSeek
$3,92
DeepSeek V4 ProAvoin (isännöity)Lippulaiva
44
$0,44$0,87
$1,31
Lippulaiva; cache-hit input 1/10 hinnasta · AA v4.1: 44 (reasoning)
Groq
$4,53
Llama 3.3 70BAvoin (isännöity)Keskitaso
9
$0,59$0,79
$1,38
LPU-inferenssi, erittäin nopea (~280–394 tok/s) · AA v4.1: 9 (non-reasoning)
Fireworks AI
$6,30
Llama 3.3 70BAvoin (isännöity)Keskitaso
9
$0,90$0,90
$1,80
Pay-as-you-go; DeepSeek V4 Flash halvempi (0,14/0,28) · AA v4.1: 9 (non-reasoning)
Together AI
$7,28
Llama 3.3 70BAvoin (isännöity)Keskitaso
9
$1,04$1,04
$2,08
Laaja avoimien mallien katalogi; DeepSeek V4 Pro 1,74/3,48 · AA v4.1: 9 (non-reasoning)
Anthropic
$15,00
Claude Haiku 4.5SuljettuKevyt
24
$1,00$5,00
$6,00
Nopea ja edullinen; Sonnet 5 introhinta 2/10 keskitasona · AA v4.1: 24 (non-reasoning; reasoning-tila korkeampi)
Mistral
$22,00
Mistral LargeSuljettuLippulaiva$2,00$6,00
$8,00
Eurooppalainen lippulaiva (Ranska); GDPR-ystävällinen · AA v4.1: ei tarkkaa versiota (Large 2 = 9)
Replicate
$38,75
DeepSeek R1 (token-esimerkki)Avoin (isännöity)Keskitaso
20
$3,75$10,00
$13,75
Laskuttaa useimmat mallit GPU-ajoajan mukaan, ei tokeneittain; vain harvat token-hinnoiteltuja · AA v4.1: 20
Anthropic
$75,00
Claude Opus 4.8SuljettuLippulaiva
56
$5,00$25,00
$30,00
Lippulaiva; Fast mode erikseen 10/50 · AA v4.1: 56 (reasoning)
OpenAI
$85,00
GPT-5.6 SolSuljettuLippulaiva
59
$5,00$30,00
$35,00
Lippulaiva (GA 9.7.2026); virallinen hinnasto · AA v4.1: 59 (max effort; xhigh 58, high 56)
AWS BedrockReferenssi (mallikohtainen)SuljettumallikohtainenHyperskaalaaja: hinnat vaihtelevat mallin mukaan (Claude/Llama/Mistral); alue-endpoint +10 %
Google Vertex AIReferenssi (mallikohtainen)SuljettumallikohtainenHyperskaalaaja: hinnat mallikohtaisia (Gemini/Claude/Llama); multi-region +10 %

Miten valita?

Halvimmat ovat avoimien mallien isännöijät ja DeepSeek (V4 Flash 0,14/0,28) sekä Mistral Small — murto-osa lippulaivojen hinnasta. Sama avomalli (esim. Llama 70B) maksaa eri verran eri isännöijillä: Groq on nopein (LPU), Fireworks ja Together tarjoavat laajan katalogin. DeepSeek ja Mistral ovat vahvoja jos haluat eurooppalaisen tai edullisen vaihtoehdon.

Lippulaivat (GPT-5.6, Claude Opus 4.8) maksavat 5–6× enemmän tuotoksesta, mutta ovat vahvimpia vaativassa päättelyssä. Todellinen hinta riippuu input:output-suhteesta: jos lähetät paljon kontekstia ja saat lyhyen vastauksen, input-hinta ratkaisee; chatissa output painaa enemmän. "Yhteensä"-sarake olettaa 1:1-suhteen — laske omalla suhteellasi. Suljetuilla malleilla prompt-välimuisti (cache) laskee toistuvan kontekstin hintaa merkittävästi.

Älykkyys-sarake on Artificial Analysis Intelligence Index (v4.1, 0–100) — riippumaton laatumittari, jotta halvin ei näytä automaattisesti parhaalta. Paras hinta-laatu (älykkyys per yhteishinta) on tällä hetkellä DeepSeek V4 Flash: lähes lippulaivojen taso murto-osalla hinnasta. Huom: reasoning- ja non-reasoning-tilan luvut eivät ole täysin vertailukelpoisia (tila on merkitty huomioihin), ja Mistralin tarkkaa versiota ei löytynyt indeksistä. Indeksi muuttuu — tarkista tuore luku linkistä.