hintavertailu.com · ai-api

LLM-API: hinta per miljoona tokenia

Kielimallit laskuttavat tokeneittain: erikseen syöte (input, kehote + konteksti) ja tuotos (output, mallin vastaus). Tuotos on tyypillisesti 2–5× syötettä kalliimpi. Vertailemme lippulaiva- ja edullisia malleja. Suljetut (OpenAI, Anthropic, Mistral) vs. avoimien mallien isännöijät (Groq, Together, Fireworks, DeepSeek) — joilla sama avomalli voi maksaa hyvin eri verran.

Hinnat tarkistettu mallia
Säädä kuukausikäyttö liukusäätimillä — $/kk-sarake laskee kustannuksen (input Mtok × input $/1M + output Mtok × output $/1M) · järjestä napsauttamalla otsikkoa · palkki = yhteishinta (1M input + 1M output)
5 Mtok/kk
2 Mtok/kk

Palvelu $/kk valitulla käytöllä Malli Tyyppi Taso Älykkyys (AA) Input $/1M Output $/1M Yhteensä (1M+1M) Huomiot
DeepSeekHalvinParas hinta-laatu
$1,26
DeepSeek V4 FlashAvoin (isännöity)Keskitaso
40
$0,14$0,28
$0,42
Halvin; virallinen API-hinnasto; deepseek-chat/reasoner vanhenevat 24.7.2026 · AA v4.1: 40 (reasoning)
Mistral
$1,95
Mistral Small 4SuljettuKevyt$0,15$0,60
$0,75
Standard API, globaali päätepiste; EU-aluehinnoittelu +10 % erikseen · AA v4.1: ei tarkkaa versiota
OpenAI
$3,50
GPT-5.4 nanoSuljettuKevyt
38
$0,20$1,25
$1,45
Halvin OpenAI-taso; virallinen hinnasto · AA v4.1: 38 (reasoning xhigh)
DeepSeek
$3,92
DeepSeek V4 ProAvoin (isännöity)Lippulaiva
44
$0,44$0,87
$1,31
Lippulaiva; cache-hit input 1/10 hinnasta · AA v4.1: 44 (reasoning)
Groq
$4,53
Llama 3.3 70BAvoin (isännöity)Keskitaso
9
$0,59$0,79
$1,38
LPU-inferenssi, erittäin nopea (~280–394 tok/s) · AA v4.1: 9 (non-reasoning)
Mistral
$5,50
Mistral Large 3SuljettuLippulaiva$0,50$1,50
$2,00
Standard API, globaali päätepiste; EU-aluehinnoittelu +10 % erikseen · AA v4.1: ei tarkkaa versiota
Fireworks AI
$6,30
Llama 3.3 70BAvoin (isännöity)Keskitaso
9
$0,90$0,90
$1,80
Pay-as-you-go; DeepSeek V4 Flash halvempi (0,14/0,28) · AA v4.1: 9 (non-reasoning)
Together AI
$7,28
Llama 3.3 70BAvoin (isännöity)Keskitaso
9
$1,04$1,04
$2,08
Laaja avoimien mallien katalogi; DeepSeek V4 Pro 1,74/3,48 · AA v4.1: 9 (non-reasoning)
Anthropic
$15,00
Claude Haiku 4.5SuljettuKevyt
24
$1,00$5,00
$6,00
Nopea ja edullinen; Sonnet 5 introhinta 2/10 keskitasona · AA v4.1: 24 (non-reasoning; reasoning-tila korkeampi)
Replicate
$38,75
DeepSeek R1 (token-esimerkki)Avoin (isännöity)Keskitaso
20
$3,75$10,00
$13,75
Laskuttaa useimmat mallit GPU-ajoajan mukaan, ei tokeneittain; vain harvat token-hinnoiteltuja · AA v4.1: 20
OpenAI
$60,00
GPT-5.6 SolSuljettuLippulaiva
59
$4,00$20,00
$24,00
Standard API; kampanjahinta vähintään 21.11.2026 asti; yli 272k syötteellä 2× input ja 1,5× output · AA v4.1: 59 (max effort; xhigh 58, high 56)
Anthropic
$75,00
Claude Opus 4.8SuljettuLippulaiva
56
$5,00$25,00
$30,00
Lippulaiva; Fast mode erikseen 10/50 · AA v4.1: 56 (reasoning)
AWS BedrockReferenssi (mallikohtainen)SuljettumallikohtainenHyperskaalaaja: hinnat vaihtelevat mallin mukaan (Claude/Llama/Mistral); alue-endpoint +10 %
Google Vertex AIReferenssi (mallikohtainen)SuljettumallikohtainenHyperskaalaaja: hinnat mallikohtaisia (Gemini/Claude/Llama); multi-region +10 %

Miten valita?

Halvimmat ovat avoimien mallien isännöijät ja DeepSeek (V4 Flash 0,14/0,28) sekä Mistral Small — murto-osa lippulaivojen hinnasta. Sama avomalli (esim. Llama 70B) maksaa eri verran eri isännöijillä: Groq on nopein (LPU), Fireworks ja Together tarjoavat laajan katalogin. DeepSeek ja Mistral ovat vahvoja jos haluat eurooppalaisen tai edullisen vaihtoehdon.

Lippulaivat (GPT-5.6, Claude Opus 4.8) maksavat 5–6× enemmän tuotoksesta, mutta ovat vahvimpia vaativassa päättelyssä. Todellinen hinta riippuu input:output-suhteesta: jos lähetät paljon kontekstia ja saat lyhyen vastauksen, input-hinta ratkaisee; chatissa output painaa enemmän. "Yhteensä"-sarake olettaa 1:1-suhteen — laske omalla suhteellasi. Suljetuilla malleilla prompt-välimuisti (cache) laskee toistuvan kontekstin hintaa merkittävästi.

Älykkyys-sarake on Artificial Analysis Intelligence Index (v4.1, 0–100) — riippumaton laatumittari, jotta halvin ei näytä automaattisesti parhaalta. Paras hinta-laatu (älykkyys per yhteishinta) on tällä hetkellä DeepSeek V4 Flash: lähes lippulaivojen taso murto-osalla hinnasta. Huom: reasoning- ja non-reasoning-tilan luvut eivät ole täysin vertailukelpoisia (tila on merkitty huomioihin), ja Mistralin tarkkaa versiota ei löytynyt indeksistä. Indeksi muuttuu — tarkista tuore luku linkistä.