Mitä tekoälyn käyttö maksaa kuukaudessa?

Näin käyttökustannus muodostuu ja pysyy hallinnassa

Mitä tekoälyn käyttö maksaa kuukaudessa?

17.9.20265 min lukuaika

Tekoälyn käyttö laskutetaan tokeneina eli tekstin palasina, ei käyttäjien tai kuukausien mukaan. Yhden automaation käyttökustannus on tyypillisesti kymmeniä dollareita kuukaudessa, ei tuhansia, ja se on laskettavissa etukäteen kolmesta luvusta: kuinka monta kertaa automaatio ajetaan, kuinka paljon tekstiä se lukee ja kuinka paljon se kirjoittaa. Suurin kustannusriski ei ole korkea hinta vaan se, ettei kenelläkään ole vastuuta luvun seuraamisesta.

Automaation hinnasta puhutaan yleensä vain toteutuksen kustannuksena. Se on ymmärrettävää, koska toteutus on se, mistä tarjous tehdään. Käyttöönoton jälkeen jää kuitenkin toinen luku, joka toistuu joka kuukausi niin kauan kuin automaatio on käytössä. Tämä artikkeli kertoo, mistä se muodostuu ja miten se pidetään kurissa.

Tekoälyn käyttökustannus lyhyesti

Laskutusyksikkö:
Token eli tekstin palanen, noin 0,75 sanaa englanniksi. Syötteestä ja tuotoksesta laskutetaan eri hinta, ja tuotos on aina kalliimpi.
Hintahaarukka:
Kevyin nykymalli maksaa 1 dollarin miljoonalta syötetokenilta ja 5 dollaria miljoonalta tuotostokenilta, tehokkain viisi kertaa enemmän.
Kolme suurinta kustannusajuria:
Ajojen määrä, mukaan luetun tekstin määrä ja mallivalinta. Järjestys on lähes aina tämä.
Halvin korjausliike:
Välimuisti. Toistuvan ohjeistuksen lukeminen välimuistista maksaa 10 % normaalihinnasta.
Mitä token-hinta ei kata:
Valmiit agenttialustat laskuttavat usein myös ajoista, työkaluista ja integraatioista, joten kahta tarjousta ei voi verrata pelkällä token-hinnalla.
Yleisin virhe:
Kustannusta ei seurata kenenkään toimesta, jolloin moninkertaistuminen huomataan vasta laskulta.

Mistä tekoälyn käyttökustannus muodostuu?

Käyttökustannus syntyy tokeneista. Token on tekstin palanen, noin 0,75 sanaa englanninkielisessä tekstissä, ja jokainen tekoälykutsu laskutetaan kahdesta luvusta: kuinka monta tokenia malli luki (syöte) ja kuinka monta se kirjoitti (tuotos). Tuotos on tyypillisesti viisi kertaa syötettä kalliimpaa.

Mallin valinta on kustannuksen kolmas kerroin. Saman työn voi tehdä kevyellä tai tehokkaalla mallilla, ja ero on viisinkertainen:

MalliSyöte / miljoona tokeniaTuotos / miljoona tokenia
Claude Haiku 4.51 dollari5 dollaria
Claude Sonnet 52 dollaria10 dollaria
Claude Opus 55 dollaria25 dollaria

Käytännön mittakaava: Anthropicin oman esimerkkilaskelman mukaan 10 000 asiakaspalvelutiketin käsittely kuluttaa keskimäärin noin 3 700 tokenia keskustelua kohden, ja kevyimmällä mallilla koko erä kustantaa noin 37 dollaria. Tuhat tikettiä siis maksaa alle neljä dollaria. Tämä on oikea suuruusluokka, ja useimmat arvaavat sen liian suureksi.

Nämä luvut koskevat tekstiä, eli tekstin lukemista ja tuottamista. Samat mallit käsittelevät myös kuvia, dokumentteja ja puhetta, ja periaate on niissä täsmälleen sama: sisältö muutetaan tokeneiksi ja tokenit laskutetaan. Määrät vain ovat toista luokkaa. Kuva pilkotaan 28 kertaa 28 pikselin ruutuihin, joten tavallinen 1 000 kertaa 1 000 pikselin kuva on noin 1 300 tokenia ja 4K-kuva jopa 4 800 tokenia. Yksi 4K-kuva kuluttaa siis enemmän kuin koko edellä mainittu asiakaspalvelukeskustelu. Jos automaatio käsittelee skannattuja dokumentteja, valokuvia tai ääntä, laske tokenit sen mukaan eikä tekstimäärän perusteella.

Paljonko tyypillinen automaatio kuluttaa kuukaudessa?

Otetaan esimerkiksi automaatio, joka käy myyntiputken kaupat läpi kerran viikossa ja kirjoittaa jokaisesta lyhyen riskiarvion. Oletetaan 200 kauppaa, 8 000 tokenia luettavaa dataa ja ohjeistusta per kauppa ja 1 200 tokenia kirjoitettua arviota. Se on 800 ajoa kuukaudessa.

MalliKustannus per ajoKustannus per kuukausi
Claude Haiku 4.50,014 dollarianoin 11 dollaria
Claude Sonnet 50,028 dollarianoin 22 dollaria
Claude Opus 50,070 dollarianoin 56 dollaria

Sama logiikka pätee mihin tahansa automaatioon: ajojen määrä kertaa yhden ajon tokenit kertaa mallin hinta. Jos kolme näistä luvuista on tiedossa, kuukausikustannus on laskettavissa ennen kuin riviäkään koodia on kirjoitettu.

Huomaa, että tämä on eri luku kuin toteutuksen hinta. Kun vertaat valmista työkalua ja räätälöityä toteutusta, molempien kokonaiskustannus muodostuu toteutuksesta, käytöstä ja ylläpidosta. Käsittelimme tätä vertailua erikseen artikkelissa milloin räätälöity AI-ratkaisu kannattaa valmiin työkalun sijaan, jossa näkökulma on kolmen vuoden kokonaiskustannus.

Tekoälyn käyttökustannusten seuranta ja budjetointi

Mitä token-kustannuksen lisäksi laskutetaan?

Tokenit ovat vain yksi rivi laskulla. Valmiit agentti- ja automaatioalustat laskuttavat tyypillisesti myös suorituksista ja käytetyistä työkaluista, ja nämä erät voivat ylittää itse mallin kustannuksen.

Tyypillisiä eriä tokenien päälle:

  • Ajot tai aktivoinnit. Moni alusta hinnoittelee sen mukaan, montako kertaa työnkulku käynnistyy, ei sen mukaan montako tokenia se kuluttaa.
  • Työkalut ja integraatiot. Jokainen kytketty järjestelmä voi olla oma maksunsa, ja osalla alustoista integraatiot laskutetaan lisenssistä erillään.
  • Palvelinaika. Koodin ajaminen tai agenttisession pitäminen käynnissä laskutetaan usein ajan mukaan. Anthropicin hinnoittelussa agenttisession ajoaika on 0,08 dollaria tunnilta ja koodin ajaminen 0,05 dollaria tunnilta konttia kohden sen jälkeen, kun kuukauden 1 550 ilmaista tuntia on käytetty.
  • Haut ja muut ulkoiset kutsut. Verkkohaku on tyypillinen esimerkki: se maksaa 10 dollaria tuhannelta haulta tokenien lisäksi.

Käytännön seuraus on, ettei kahta tarjousta voi verrata pelkällä token-hinnalla. Kysy aina, mitä laskutetaan tokenien lisäksi ja millä yksiköllä. Räätälöidyssä toteutuksessa erät ovat yleensä läpinäkyvämmät, koska maksat suoraan mallin ja infran kustannuksen ilman alustan katetta, mutta silloin infra on myös omalla vastuulla.

Miksi kustannus voi moninkertaistua ilman että kukaan huomaa?

Käyttökustannus nousee harvoin hinnankorotuksen takia. Se nousee siksi, että jokin kolmesta kertoimesta muuttuu hiljaa, eikä muutos näy missään ennen laskua.

Neljä yleisintä syytä:

  • Mukaan luettavan tekstin määrä kasvaa. Automaatio, joka luki alussa kaupan perustiedot, lukee vuoden päästä koko keskusteluhistorian. Tokenit kolminkertaistuvat, vaikka toiminnallisuus näyttää samalta.
  • Agentti ottaa monta kierrosta yhden sijaan. Tekoälyagentti, joka suunnittelee työvaiheet itse, tekee saman tehtävän aikana helposti kymmenen kutsua eikä yhtä. Ero perinteiseen automaatioon on tässä sama kuin toiminnallisuudessa, ja käsittelimme sitä tarkemmin artikkelissa mikä on tekoälyagentti ja miten se eroaa automaatiosta.
  • Malli vaihtuu tehokkaampaan kokeilun yhteydessä eikä vaihdu takaisin. Viisinkertainen hinta jää päälle, koska kokeilua ei purettu.
  • Ajojen määrä kasvaa liiketoiminnan mukana. Kaksinkertainen asiakasmäärä tarkoittaa kaksinkertaista laskua. Tämä on hyvä ongelma, mutta se pitää tietää etukäteen.

Yksi tekninen yksityiskohta kannattaa tietää: uusimmat mallit käyttävät uutta tokenisoijaa, joka tuottaa samasta tekstistä noin 30 prosenttia enemmän tokeneita kuin vanhempi. Mallipäivitys voi siis nostaa laskua, vaikka hinta per token pysyisi samana.

Miten käyttökustannus pidetään hallinnassa?

Kustannus pidetään hallinnassa neljällä liikkeellä, jotka kannattaa tehdä tässä järjestyksessä. Kolme ensimmäistä eivät heikennä laatua lainkaan.

  1. Ota välimuisti käyttöön. Jos jokainen ajo lukee saman ohjeistuksen ja saman taustatiedon, se kannattaa tallentaa välimuistiin. Välimuistista luettu teksti maksaa 10 prosenttia normaalista syötehinnasta. Esimerkkiautomaatiossamme, jossa 6 000 tokenia kahdeksasta tuhannesta on joka kerta samaa, tämä pudottaa kuukausikustannuksen 22 dollarista noin 14 dollariin. Välimuisti maksaa itsensä takaisin jo ensimmäisen luvun jälkeen.
  2. Siirrä kiireetön työ eräajoon. Työ, jonka tulos tarvitaan huomenna eikä viiden sekunnin päästä, voidaan ajaa erissä. Eräajo on 50 prosenttia halvempi sekä syötteestä että tuotoksesta, ja alennus kertautuu välimuistin kanssa. Yön yli ajettava viikkoraportti ei tarvitse reaaliaikaista käsittelyä.
  3. Karsi turha teksti syötteestä. Suurin osa liian kalliista automaatioista lukee dataa, jota se ei käytä. Kun syötteestä poistetaan kentät, joita malli ei tarvitse, kustannus laskee suoraan samassa suhteessa. Tämä on sama harjoitus kuin prosessin rajaaminen, ja se kannattaa tehdä samalla kertaa. Pohjan tähän antaa prosessien pisteytys ensimmäisen automaatiokohteen valintaan, johon kustannus on luonteva neljäs mittari.
  4. Valitse malli tehtävän mukaan, ei varmuuden vuoksi. Luokittelu, poiminta ja tiivistäminen onnistuvat kevyimmällä mallilla. Tehokkain malli kannattaa varata sille työlle, jossa päättely aidosti ratkaisee. Tämä on ainoa näistä neljästä, jossa säästö voi maksaa laatua, joten se tehdään vasta kun kolme edellistä on tehty.

Tälle kustannuskurille on englanninkielinen nimi, tokenomics, ja se tarkoittaa käytännössä samaa kuin FinOps pilvikulutuksessa: kulutus mitataan, sille asetetaan budjetti ja poikkeamat nostetaan esiin automaattisesti. Pk-yritys ei tarvitse tähän omaa työkalua, mutta se tarvitsee nimetyn vastuuhenkilön ja kuukausittaisen luvun.

Jos haluat ensin suuruusluokan omasta tilanteestasi, automaatiopotentiaalin itsearviointi kertoo, mihin prosesseihin kannattaa katsoa ensin.

Mitä kysyä toimittajalta ennen sopimusta?

Ennen toteutussopimusta kannattaa kysyä viisi kysymystä, joihin vastaukset ovat numeroita tai kyllä ja ei, eivät arvioita.

  • Mikä on arvioitu käyttökustannus kuukaudessa nykyisellä volyymilla, ja mihin lukuihin arvio perustuu?
  • Mitä laskutetaan tokenien lisäksi, ja millä yksiköllä: ajot, työkalut, integraatiot, palvelinaika?
  • Mitä tapahtuu, jos volyymi kaksinkertaistuu?
  • Onko välimuisti käytössä, ja mikä osuus syötteestä on välimuistitettavaa?
  • Mikä malli on käytössä missä työvaiheessa, ja kuka päättää sen vaihtamisesta?
  • Miten kulutus raportoidaan meille, ja kuka huomaa poikkeaman?

Viimeinen kysymys on niistä tärkein. Kustannus, jota kukaan ei seuraa, on sama riski kuin valvomaton tekoälytuotos. Mallivalinta vaikuttaa muuten myös siihen, minne data liikkuu, joten tämä keskustelu kannattaa käydä samalla kertaa kuin tekoälyn tietoturvan tarkistuslista ennen käyttöönottoa.

Yhteenveto

Tekoälyn käyttö maksaa vähemmän kuin useimmat pelkäävät. Ongelma ei olekaan hinta vaan se, ettei lukua budjetoida eikä seurata. Kuukausikustannus on kolmen luvun tulo: ajojen määrä, tokenit per ajo ja mallin hinta. Yksittäinen automaatio asettuu tyypillisesti kymmeniin dollareihin kuukaudessa. Valmiilla alustalla päälle tulevat vielä ajo-, työkalu- ja integraatiomaksut, ja kuvia tai dokumentteja käsittelevässä automaatiossa tokenimäärät ovat selvästi tekstiä suuremmat.

Hallinta ei vaadi uutta työkalua. Se vaatii välimuistin, eräajon kiireettömälle työlle, karsitun syötteen ja tehtävään sopivan mallin, sekä yhden ihmisen, joka katsoo lukua kuukausittain. Nämä kannattaa päättää toteutuksen yhteydessä, koska jälkikäteen ne ovat muutostyö.

Selvitä, mitä automaatio maksaa ja mitä se tuottaa

Kiinteähintainen automaatiokartoitus käy prosessinne läpi ja kertoo jokaisesta automaatiokohteesta sen euromääräisen hyödyn sekä sen, mitä käyttöönotto ja käyttö vaativat.

Varaa automaatiokartoitus

Empirica Finland on erikoistunut tekoälyratkaisuihin B2B-ympäristössä ja on Claude Partner Network -jäsen sekä Microsoft-kumppani.

← Takaisin pääsivulle

Lähteet

Mihin tämän artikkelin väitteet perustuvat?

  1. Pricing

    Anthropic, julkaistu 17. syyskuuta 2026

    Lähde artikkelin mallikohtaisille hinnoille, eräajon 50 % alennukselle, välimuistin hintakertoimille ja verkkohaun hinnalle. Hinnat tarkistettu 17.9.2026.

  2. Prompt caching

    Anthropic, julkaistu 17. syyskuuta 2026

    Välimuistin toimintaperiaate: luku maksaa 10 % perushinnasta, kirjoitus 1,25-kertaisen (5 min) tai 2-kertaisen (1 h).

  3. Vision

    Anthropic, julkaistu 17. syyskuuta 2026

    Lähde kuvien token-määrille: kuva pilkotaan 28 x 28 pikselin ruutuihin, joten 1000 x 1000 pikselin kuva on 1 296 tokenia ja 4K-kuva enintään 4 784 tokenia.

Lähteiden tiedot on tarkistettu 17. syyskuuta 2026.

KategoriaRäätälöidyt AI-ratkaisut ja integraatiot