Tekoälylaskennan hinta on muuttunut liikkuvaksi maalitauluksi. Syyskuussa 2026 saman Nvidia H100 -grafiikkapiirin pilvivuokra voi maksaa 1,25 dollaria tunnissa halvimmalla neopilvellä tai yli 12 dollaria tunnissa hyperskaalaajan listahinnalla. Ero on jopa kymmenkertainen samasta raudasta, ja ilmiö toistuu uudemman H200-sirun sekä tuoreiden Blackwell-piirien B200 ja B300 kohdalla. Taustalla vaikuttaa sama muistipula, joka on jo nostanut kuluttajien näytönohjainhintoja, mutta yritysasiakkaiden puolella tilanne on vielä sekavampi: osa pilvipalveluista laskee hintoja kilpailun kiristyessä, toiset nostavat niitä kysynnän ylittäessä kapasiteetin.

IntuitionLabsin 14. syyskuuta 2026 päivitetyn analyysin mukaan H100-piirin pilvivuokra on pudonnut alkuvuoden keskiarvoon 3,11 dollaria tunnissa, kun taas uudemman H200:n hinnat liikkuvat 3,50 ja 10,60 dollarin välillä tunnissa käytetystä palveluntarjoajasta riippuen. Suomalaisille ja pohjoismaisille yrityksille tämä ei ole pelkkä amerikkalainen kuriositeetti: Nebius, jolla on merkittävä läsnäolo myös Suomessa, ja saksalainen Hetzner ovat molemmat tuoneet GPU-vuokrauksen lähemmäs eurooppalaista asiakasta, mikä muuttaa koko alueen tekoälylaskennan kustannusrakennetta.

Hintojen hajonta ei ole vain markkinointitempaus tai lyhytaikainen poikkeama. Getdeployingin yli 80 palveluntarjoajaa ja 5 100 hintapistettä kattava seuranta osoittaa, että GPU-pilvi on edelleen yksi harvoja pilvipalveluiden osa-alueita, jossa hinta ei ole vakiintunut yhteen tasoon toimialan kypsyydestä huolimatta. Tämä tekee hinnan vertailusta työlästä mutta samalla avaa mahdollisuuden merkittäviin säästöihin niille, jotka jaksavat etsiä oikean tarjoajan oikeaan työkuormaan.

Mikä ajaa H100- ja H200-vuokrahintoja juuri nyt

GPU-pilvimarkkina on jakautunut kahteen leiriin. Toisella puolella ovat hyperskaalaajat kuten AWS, Azure ja Google Cloud, jotka myyvät valmiiksi paketoitua, korkean palvelutason infrastruktuuria. Toisella puolella ovat niin sanotut neopilvet, kuten CoreWeave, Lambda, RunPod, Vast.ai ja Nebius, jotka kilpailevat lähes puhtaasti hinnalla. Aimultiplen GPU-pilvihintaindeksin mukaan hyperskaalaajat veloittavat samasta piiristä tyypillisesti kolmesta kuuteen kertaa enemmän kuin neopilvet, ja ero näkyy suoraan H100- ja H200-tarjonnassa syyskuussa 2026.

Hintaheittelyn taustalla on kolme päällekkäistä ilmiötä. Ensimmäinen on jatkuva kysynnän kasvu suurten kielimallien koulutuksessa ja päättelyssä, joka pitää huipputason klustereiden käyttöasteen korkealla. Toinen on Blackwell-sukupolven B200- ja B300-piirien tulo markkinoille, mikä on osittain vapauttanut vanhempaa H100-kapasiteettia ja painanut sen hintoja alaspäin. Kolmas, ja ehkä pitkäkestoisin, on korkean kaistanleveyden muistin eli HBM:n niukkuus, joka nostaa jokaisen uuden piirin valmistuskustannusta riippumatta siitä, kuka sen lopulta ostaa tai vuokraa.

Kysynnän luonne on myös muuttunut vuoden 2026 aikana. Aiemmin suurin osa GPU-kysynnästä tuli suurten kielimallien koulutusajoista, jotka voitiin ajastaa ja aikatauluttaa etukäteen. Nyt yhä suurempi osa kuormasta on päättelyä eli inferenssiä, joka reagoi suoraan käyttäjien kysyntään ja vaihtelee tunneittain. Tämä siirtymä selittää osan hintojen lyhytaikaisesta heittelystä: kun miljoonat käyttäjät kirjautuvat samaan tekoälypalveluun ruuhka-aikaan, spot-hinnat markkinapaikoilla voivat nousta nopeasti, vaikka keskiarvo pysyisi laskusuunnassa. Koulutusajot puolestaan siirtyvät yhä useammin uusimmille B200- ja B300-piireille, mikä vapauttaa H100-kapasiteettia päättelykäyttöön ja painaa sen tuntihintaa alaspäin.

H100-pilvivuokran hinnat palveluntarjoajittain

Yksittäisen palveluntarjoajan hinta riippuu ennen kaikkea siitä, minkä tyyppisestä sopimuksesta on kyse. Spot-hinnat, joissa asiakas voi menettää instanssin lyhyellä varoitusajalla, ovat halvimpia. Vakaat, varatut instanssit maksavat enemmän mutta takaavat käytettävyyden. Jarvislabsin hinnaston mukaan sen H100-instanssi maksaa 2,69 dollaria tunnissa, kun taas Spheron Networkin hintavertailussa H100-vuokraus alkaa 2,01 dollarista tunnissa.

Neopilvet halvimmillaan, hyperskaalaajat kalleimmillaan

IntuitionLabsin 15 palveluntarjoajan vertailussa H100:n hinta liikkuu 1,49 ja 6,98 dollarin välillä tunnissa, kun taas laajemmassa markkinaseurannassa spot-hinnat ovat pudonneet jopa 1,25 dollariin tunnissa parhaimmillaan. Alla oleva taulukko kokoaa syyskuun 2026 tason eri segmenteistä.

Spot- ja varattujen instanssien hintaero

CoreWeaven kahdeksan H100:n HGX-solmu maksaa on-demand-sopimuksella 49,24 dollaria tunnissa, mikä vastaa noin 6,16 dollaria yhtä piiriä kohden. Spot-hinnalla sama solmu on saatavilla jo 19,71 dollarilla tunnissa, eli noin 2,46 dollarilla piiriä kohden. Vast.ain markkinapaikalla H100 SXM -vuokraukset alkavat 1,33 dollarista tunnissa, mutta mediaanihinta asettuu lähemmäs kahta dollaria, koska halvimmat listaukset ovat usein varattuja tai epävakaita. Lambda puolestaan hinnoittelee H100 SXM -piirinsä tasaisesti 3,99 dollariin tunnissa riippumatta sopimuspituudesta, mikä tekee siitä ennustettavan mutta ei halvimman vaihtoehdon.

SegmenttiEsimerkkipalveluH100-hinta ($/h)H200-hinta ($/h)
Markkinapaikka / spotVast.ai, spot-instanssit1,25–1,493,50–3,99
Erikoistunut neopilviJarvislabs, Spheron, RunPod2,01–2,893,59–4,59
Eurooppalainen vaihtoehtoNebius AI Cloud2,50–3,20 (arvio)3,50
Keskiarvo, koko markkinaKaikki tarjoajat yhteensä3,114,40
HyperskaalaajaAWS, Azure, Google Cloud6,88–12,297,91–10,60

Lähteet: IntuitionLabs (14.9.2026), Spheron Network, Jarvislabs, CloudZero ja Getdeploying-hintaseuranta. Hinnat ovat suuntaa antavia keskiarvoja ja voivat vaihdella tunneittain markkinapaikoilla.

H200: enemmän muistia, kalliimpi lasku

H200 ei ole H100:n pieni päivitys vaan oma kustannusluokkansa. Piirissä on 141 gigatavua HBM3e-muistia, kun H100:ssa sitä on 80 gigatavua. CloudZeron kustannusanalyysin mukaan tämä muistilisäys näkyy suoraan vuokrahinnassa: kahdeksan H200-piirin järjestelmä maksaa ostettuna noin 315 000 dollaria, kun vastaava kahdeksan H100:n kokoonpano maksaa noin 215 000 dollaria. Yksittäinen H200-piiri myydään noin 31 000–32 000 dollarilla.

Pilvivuokrauksessa RunPodin yhteisöpilven H200 SXM -instanssi on pysytellyt noin 3,59 dollarissa tunnissa suurimman osan vuotta 2026, ja Nebiuksen AI Cloud tarjoaa saman piirin 3,50 dollarilla tunnissa. Hyperskaalaajilla hinta nousee jyrkästi: Azuren ND H200 v5 -instanssit liikkuvat 10,60 dollarin tuntumassa, kun taas AWS:n p5e-instanssit asettuvat lähemmäs 5 dollaria tunnissa normalisoituna yhtä piiriä kohden.

Economize.cloudin syyskuussa 2026 päivitetyn hintavertailun mukaan AWS:n kahdeksan H200-piirin solmu maksaa 63,30 dollaria tunnissa eli noin 7,91 dollaria piiriä kohden, kun taas vastaava Azure-solmu maksaa 84,80 dollaria tunnissa eli noin 10,60 dollaria piiriä kohden. CoreWeaven H200-solmu asettuu näiden väliin, 50,44 dollariin tunnissa eli noin 6,31 dollariin piiriä kohden. Ero AWS:n ja Azuren välillä, lähes 34 prosenttia samasta piiristä, kertoo että hyperskaalaajienkin sisällä hinnoittelu vaihtelee huomattavasti eikä perustu pelkkään rautakustannukseen.

Blackwell-sukupolvi nostaa hintakattoa: B200 ja B300

Blackwell-arkkitehtuuriin perustuvat B200- ja B300-piirit ovat jo tuotannossa ja muuttavat hintaskaalaa entisestään. B200-piirissä on 180 gigatavua HBM3e-muistia, ja Nvidia väittää sen olevan jopa kolme kertaa nopeampi kuin H100 sen omassa GPT-MoE-1.8T-vertailutestissä. IntuitionLabsin mukaan yksittäinen B200-piiri myydään 30 000–50 000 dollarilla, ja täysi kahdeksan piirin palvelinjärjestelmä ylittää 500 000 dollaria.

B300, markkinoilta tunnettu nimellä Blackwell Ultra, toi tammikuussa 2026 markkinoille 288 gigatavua HBM3e-muistia eli kaksinkertaisen määrän H200:aan verrattuna. Kahdeksan B300-piirin DGX-järjestelmä maksaa 300 000–350 000 dollaria, ja pienempi DGX Station -pöytäversio asettuu 80 000–125 000 dollarin haarukkaan. Pilvivuokrauksessa varhaiset B300-hinnat liikkuvat 4,95 ja 18 dollarin välillä tunnissa, kun taas B200-vuokrat käynnistyivät alkuvuonna noin 4,40 dollarista tunnissa ja ovat sittemmin vaihdelleet 5–6 dollarin välillä kysynnän mukaan. IntuitionLabs raportoi B200-vuokraindeksin jopa nousseen 24 prosenttia maaliskuussa 2026 ennen kuin hinnat tasaantuivat uudelleen. Tällainen lyhyen aikavälin piikki on tyypillinen tilanteessa, jossa uuden sukupolven piiri on vielä tuotantorajoitteinen: kun muutama suuri asiakas varaa suuren osan saatavilla olevasta kapasiteetista, jäljellä olevasta tarjonnasta kilpaillaan hinnalla ylöspäin, kunnes tuotanto ehtii kasvaa kysynnän tasalle.

Uusimpaan Rubin-sukupolveen liittyvät hinnat ovat vielä osittain neuvottelunvaraisia, sillä toimitukset ovat vasta käynnistymässä. Aiemmin raportoitu Rubin-toimitusten alku viittaa siihen, että B200 pysyy vielä pitkään pilvipalveluiden todellisena työjuhtana, vaikka Rubin nousee lippulaivaksi vuoden 2027 aikana.

Palveluntarjoajien kilpailuasetelma: kuka voittaa hintasodan

GPU-pilvimarkkinalla kilpailee tällä hetkellä karkeasti kolme toimijaryhmää, ja jokainen kilpailee eri asialla. Hyperskaalaajat AWS, Azure ja Google Cloud myyvät ennen kaikkea integraatiota: sama laskutus, sama identiteetinhallinta ja sama tukiverkosto kuin muissakin pilvipalveluissa. Se selittää, miksi ne voivat veloittaa jopa kuusinkertaisen hinnan neopilviin verrattuna ja silti pitää suuret yritysasiakkaat. Toinen ryhmä, erikoistuneet neopilvet kuten CoreWeave, Lambda ja Jarvislabs, kilpailee suorituskyvyllä ja saatavuudella. Ne ovat rakentaneet infrastruktuurinsa yksinomaan tekoälykuormille, mikä näkyy nopeampana käyttöönottona ja parempana verkkolatenssina klustereiden sisällä, mutta hinta pysyy silti selvästi hyperskaalaajia matalampana.

Kolmas ryhmä, markkinapaikat kuten Vast.ai ja Akash, kilpailee puhtaasti hinnalla huutokauppamallilla, jossa yksittäiset palvelinomistajat tarjoavat kapasiteettiaan suoraan käyttäjille. Tämä malli tuottaa markkinan halvimmat hinnat mutta myös suurimman epävarmuuden, sillä hinta ja saatavuus voivat vaihdella jopa 2–3-kertaisesti vuorokauden sisällä riippuen kysynnästä ja paikallisista sähkökustannuksista. Nebius asemoituu näiden väliin: se tarjoaa hyperskaalaajaa muistuttavan hallitun palvelun mutta neopilven hintatason, mikä on yksi syy sen kasvuun erityisesti Euroopassa ja Suomessa.

HBM-muistipula pitää hinnat epävakaina

Yksittäisten palveluntarjoajien hintaerojen takana on rakenteellinen syy: korkean kaistanleveyden muisti on edelleen niukkaa. Epoch AI:n arvion mukaan, jonka IntuitionLabs siteeraa raportissaan, HBM-muisti muodostaa noin puolet B200-piirin arvioidusta 6 400 dollarin valmistuskustannuksesta. Kun Samsung ja SK Hynix ohjaavat tuotantoaan yhä enemmän tekoälypiirien tarpeisiin, sama niukkuus näkyy myös kuluttajapuolella. HBM4-muistisodaksi kutsuttu kilpailu Samsungin, SK Hynixin ja Micronin välillä on pitänyt varastotasot poikkeuksellisen matalina koko kesän 2026 ajan. IntuitionLabsin raportti viittaa myös Reutersin tietoihin, joiden mukaan HBM-muistin hinta on paikoin kaksinkertaistunut, kun tuotantoa on siirretty kuluttajamuistista tekoälypiirien tarpeisiin.

Sama muistipula selittää, miksi H100-pilvivuokrat ovat laskeneet samaan aikaan kun H200- ja B-sarjan vuokrat pysyvät korkealla. Vanhempi H100 käyttää halvempaa 80 gigatavun HBM3-muistia, joten sen tuotanto on helpompi skaalata, kun taas uudemmat piirit kilpailevat samasta niukasta HBM3e- ja HBM4-tuotannosta kuluttajien näytönohjainten ja muiden tekoälykiihdyttimien kanssa.

Osto vai vuokraus: milloin yritys hyötyy kummastakin

IntuitionLabsin analyysi päätyy selkeään nyrkkisääntöön: jatkuvassa, ympärivuorokautisessa käytössä oman raudan ostaminen maksaa itsensä takaisin kuukausissa, ei vuosissa, kun sitä verrataan hyperskaalaajan listahintoihin. Lyhytkestoisille projekteille ja vaihtelevalle kuormalle pilvivuokraus pysyy järkevämpänä, koska se välttää suuren alkuinvestoinnin ja jäännösarvoriskin.

Yksinkertainen kustannuslaskelma kahdeksan GPU:n klusterille

Ohjelmistokehittäjille ja pilviarkkitehdeille hyödyllinen nyrkkisääntö on laskea kuukausikustannus tuntihinnasta ennen sopimuksen tekemistä. Alla yksinkertaistettu esimerkki kahdeksan H100-piirin klusterista jatkuvassa käytössä.

tuntihinta_per_gpu = 3.11      # keskiarvo, IntuitionLabs 9/2026
gpu_maara = 8
tunnit_kuukaudessa = 730

kuukausikustannus = tuntihinta_per_gpu * gpu_maara * tunnit_kuukaudessa
# = 3.11 * 8 * 730 = 18 162.80 dollaria/kk neopilvessa

hyperscaler_hinta = 8.50
hyperscaler_kk = hyperscaler_hinta * gpu_maara * tunnit_kuukaudessa
# = 8.50 * 8 * 730 = 49 640.00 dollaria/kk hyperskaalaajalla

Ero kuukausitasolla, yli 31 000 dollaria samasta laskentatehosta, selittää miksi yhä useampi startup ja tutkimusryhmä valitsee neopilven, vaikka se tarkoittaisi hieman heikompaa palvelutasoa tai lyhyempää irtisanomisaikaa.

Hintakehitys sukupolvesta toiseen: A100:sta Blackwelliin

Historiallinen vertailu näyttää, kuinka jyrkästi ostohinnat ovat nousseet sukupolvi kerrallaan, samalla kun pilvivuokrat ovat kussakin sukupolvessa laskeneet ajan myötä kilpailun kiristyessä.

PiiriMuistiOstohinta/piiri8-GPU-järjestelmäPilvivuokra ($/h)
A10040/80 GB HBM2e10 000–17 000 $~200 000 $1,00–2,50
H10080 GB HBM325 000–40 000 $~215 000 $1,25–6,98
H200141 GB HBM3e31 000–32 000 $~315 000 $3,50–10,60
B200180 GB HBM3e30 000–50 000 $yli 500 000 $4,40–6,00
B300288 GB HBM3e37 500–43 750 $ (arvio)300 000–350 000 $4,95–18,00

Lähde: IntuitionLabs, NVIDIA AI GPU Pricing Guide, päivitetty 14.9.2026. Kahdeksan piirin järjestelmähinnat ovat suuntaa antavia listahintoja, eivät todellisia toteutuneita kauppahintoja.

Pohjoismainen näkökulma: Nebius, Hetzner ja paikallinen kapasiteetti

Suomalaiselle ja pohjoismaiselle asiakkaalle GPU-vuokrauksen hintakartta ei näytä samalta kuin yhdysvaltalaiselle. Nebius on rakentanut merkittävää läsnäoloa Suomessa osana laajempaa Nvidia-yhteistyötä, ja sen AI Cloud -palvelu hinnoittelee H200-piirin 3,50 dollariin tunnissa, mikä asettuu selvästi alle amerikkalaisten hyperskaalaajien tason. Saksalainen Hetzner puolestaan toi markkinoille GEX45-palvelimen, jonka kuukausihinta alkaa 214 eurosta ja tarjoaa eurooppalaisille kehittäjille vaihtoehdon ilman Atlantin ylittävää latenssia tai dollarikurssiriskiä.

Myös Islannin kautta Pohjolaan tuodut H200-piirit ja Suomeen suunnitellut uudet datakeskusinvestoinnit vahvistavat samaa trendiä: laskentateho siirtyy lähemmäs eurooppalaista asiakasta, mikä painaa hintoja alaspäin paikallisesti, vaikka globaali kysyntä pysyisi korkealla. Tämä on erityisen merkittävää suomalaisille tekoälystartupeille ja tutkimuslaitoksille, joille rajat ylittävä datansiirto tai GDPR-vaatimukset voivat tehdä amerikkalaisen pilven käytöstä hankalaa riippumatta hinnasta.

Suomalaisen konesalisektorin kannalta kehitys liittyy myös laajempaan investointiaaltoon: kylmä ilmasto ja vakaa, vähäpäästöinen sähköntuotanto ovat houkutelleet tekoälyinfrastruktuuria maahan viime kuukausina useiden isojen ilmoitusten myötä. Kun laskentakapasiteettia rakennetaan lähemmäs Suomea, myös GPU-vuokrauksen hintakilpailu todennäköisesti kiristyy paikallisella tasolla, mikä voi hyödyttää erityisesti keskisuuria yrityksiä, joilla ei ole neuvotteluvoimaa hankkia suoria sopimuksia amerikkalaisten hyperskaalaajien kanssa.

Sama muistipula nostaa kuluttajien näytönohjainhintoja

Yritysasiakkaiden pilvivuokrat ja kuluttajien näytönohjainhinnat kulkevat nyt vastakkaisiin suuntiin samasta syystä. Kun HBM-tuotantoa ohjataan yhä enemmän datakeskuspiireihin, pelaajien ja luovan alan ammattilaisten RTX-sarjan näytönohjainten hinnat ovat nousseet samaan aikaan kun osa yritysvuokrista laskee kilpailun ansiosta. Ilmiö on epäintuitiivinen mutta looginen: H100 ei enää kilpaile suoraan uusimmasta HBM-muistista, joten sen vuokra voi laskea, kun taas kuluttajakortit ja uusimmat datakeskuspiirit kilpailevat samasta rajallisesta muistivarannosta.

Kilpailu kiristyy: Google TPU, AMD ja mukautetut sirut

Nvidian hintavaltaa haastaa yhä useampi vaihtoehto. Google on lisännyt oman TPU-infrastruktuurinsa tarjontaa, AMD:n Instinct-sarja kilpailee suoraan H100- ja H200-luokassa, ja useat hyperskaalaajat kehittävät omia mukautettuja tekoälypiirejään vähentääkseen riippuvuuttaan Nvidiasta. AWS:n elokuussa 2026 ilmoittama kahden miljoonan lisä-GPU:n tilaus Nvidialta osoittaa kuitenkin, että kysyntä Nvidian omalle raudalle ei ole hiipumassa lähivuosina, vaikka vaihtoehdot yleistyvät taustalla.

Kilpailun kiristyminen näkyy erityisesti neopilvien hinnoittelussa. Kun useampi tarjoaja pystyy myymään sekä Nvidia- että vaihtoehtoista laskentatehoa, hintaneuvotteluvara kasvaa suurille asiakkaille, ja tämä painaa keskihintoja alaspäin nopeammin kuin pelkkä raudan halpeneminen selittäisi.

Google on erityisen kiinnostava tapaus, koska sen omat TPU-piirit eivät kilpaile Nvidian kanssa avoimella markkinalla samalla tavalla kuin H100 tai H200: ne ovat saatavilla vain Google Cloudin kautta, joten niiden hintavaikutus näkyy epäsuorasti, painostamalla Googlea pitämään oman pilvensä Nvidia-instanssit kilpailukykyisinä. AMD:n Instinct-sarja puolestaan kilpailee suoraan samoilla neopilvillä kuin H100 ja H200, mikä antaa asiakkaille aidon vaihtoehdon erityisesti silloin, kun työkuorma ei vaadi Nvidian CUDA-ekosysteemiä.

Mitä alan seuraajat ennustavat loppuvuodelle

Opslyftin syyskuun 2026 katsauksen mukaan H100-vuokrahintojen lasku on hidastumassa loppuvuotta kohti, sillä markkina lähestyy tasapainoa neopilvien ja hyperskaalaajien välillä. Samalla H200- ja B200-hinnat todennäköisesti pehmenevät vasta, kun Blackwell-tuotantokapasiteetti kasvaa riittävästi ja HBM-tarjonta helpottaa. Getdeployingin hintaseurannan mukaan yli 80 palveluntarjoajaa ja 5 100 hintapistettä kattava markkina on edelleen liian pirstaloitunut yhtenäiselle hintakehitykselle, mikä pitää yllä suuria alueellisia ja tarjoajakohtaisia eroja.

Seuraavat kuukaudet näyttävät, kuinka nopeasti markkina löytää uuden tasapainon. Analyytikot ovat yksimielisiä siitä, että suunta on edelleen alaspäin vanhemmilla piireillä, mutta erimielisiä siitä, kuinka nopeasti uusimpien Blackwell-piirien hinnat seuraavat perässä.

Viisi ennustetta GPU-pilvimarkkinalle

  • H100-vuokrat vakiintuvat 2–4 dollarin haarukkaan neopilvissä vuoden 2027 alkuun mennessä, kun piiri siirtyy yhä selvemmin toisen käden työjuhdaksi.
  • H200- ja B200-hintaero kapenee, kun Blackwell-tuotanto kasvaa ja H200:n 141 gigatavun muistietu menettää merkitystään uusimpiin malleihin nähden.
  • Eurooppalaiset ja pohjoismaiset vaihtoehdot, kuten Nebius ja Hetzner, kasvattavat markkinaosuuttaan erityisesti asiakkailla, joille datan sijainti ja GDPR-vaatimukset painavat enemmän kuin muutaman prosentin hintaero.
  • Rubin-sukupolven toimitusten laajentuessa B200-piirien vuokrahinnat laskevat nopeammin, samalla tavalla kuin H100 halpeni Blackwellin tullessa markkinoille.
  • HBM-muistipula pysyy hintojen kattona ainakin vuoden 2027 puolelle, joten dramaattista, koko markkinan kattavaa hintaromahdusta ei ole näköpiirissä lähikuukausina.

Mitä tämä tarkoittaa suomalaisille yrityksille ja kehittäjille

Käytännön tasolla hintavaihtelu tarkoittaa, että sama tekoälyprojekti voi maksaa moninkertaisesti riippuen siitä, mistä laskentateho hankitaan. Pienelle startupille tai tutkimusryhmälle neopilven ja hyperskaalaajan välinen ero, joissakin tapauksissa yli kolme kertaa, voi ratkaista koko projektin kannattavuuden. Suuremmille yrityksille taas palvelutason, tietoturvan ja sopimusehtojen merkitys kasvaa, kun budjetit sallivat hyperskaalaajan preemion. Kehittäjätiimien kannattaa laskea kokonaiskustannus tuntihinnan sijaan, sillä piilokustannukset kuten tiedonsiirto, tallennus ja verkkomaksut voivat nostaa lopullista laskua merkittävästi ilmoitetusta GPU-tuntihinnasta.

Moni suomalainen ohjelmistotalo on viime kuukausina siirtynyt hybridimalliin, jossa perusmallien hienosäätö ja tuotantopäättely ajetaan neopilvessä, kun taas asiakasrajapinnat ja arkaluontoisen datan käsittely pidetään hyperskaalaajan hallitussa ympäristössä. Malli maksaa enemmän kuin puhdas neopilvistrategia, mutta se vähentää riippuvuutta yksittäisestä toimittajasta tilanteessa, jossa markkinapaikan spot-hinnat voivat kaksin- tai kolminkertaistua vuorokauden sisällä kysyntäpiikin aikana.

Usein kysyttyä GPU-pilvivuokrauksen hinnoista

Miksi H100-pilvivuokra on halvempi kuin H200?
H100 käyttää halvempaa ja runsaammin saatavilla olevaa 80 gigatavun HBM3-muistia, kun taas H200:ssa on 141 gigatavua kalliimpaa HBM3e-muistia. Kysyntä on myös siirtynyt uudempiin piireihin, mikä pitää H100-kapasiteetin käyttöasteen matalampana ja hinnan alempana.

Kannattaako yrityksen ostaa vai vuokrata GPU-laskentaa?
Jatkuvassa, ympärivuorokautisessa käytössä oman raudan ostaminen maksaa itsensä takaisin kuukausissa verrattuna hyperskaalaajan listahintoihin. Lyhytkestoisille tai vaihteleville kuormille vuokraus on yleensä järkevämpi, koska se välttää suuren alkuinvestoinnin.

Miksi hyperskaalaajat veloittavat enemmän kuin neopilvet?
Hyperskaalaajat myyvät korkeamman palvelutason, laajemman tietoturvan, valmiit hallintatyökalut ja globaalin verkon, mikä nostaa hintaa. Neopilvet karsivat näitä palveluita ja kilpailevat lähes puhtaasti hinnalla.

Vaikuttaako HBM-muistipula myös kuluttajien näytönohjaimiin?
Kyllä. Sama HBM- ja DRAM-tuotantokapasiteetti jaetaan datakeskuspiirien ja kuluttajakorttien kesken, joten tekoälykysynnän kasvu on yksi syy kuluttajien näytönohjainhintojen nousuun vuonna 2026.

Onko Pohjoismaissa omia GPU-pilvivaihtoehtoja?
Kyllä. Nebiuksella on merkittävä läsnäolo Suomessa, ja Hetznerin GEX45-palvelin tarjoaa eurooppalaisen vaihtoehdon ilman Atlantin ylittävää latenssia. Myös Islannin kautta Pohjolaan tuodut H200-piirit lisäävät alueellista kapasiteettia.

Milloin B200- ja B300-hinnat laskevat?
Analyytikot odottavat hintojen pehmenevän, kun Blackwell-tuotantokapasiteetti kasvaa ja HBM-tarjonta helpottaa, todennäköisesti vasta vuoden 2027 aikana Rubin-sukupolven toimitusten edetessä.

Miksi H100-vuokrahinnat vaihtelevat niin paljon eri lähteissä?
Markkina on pirstaloitunut yli 80 palveluntarjoajan kesken, ja hinnat riippuvat sopimustyypistä, alueesta ja siitä, onko kyse spot-, varatusta vai on-demand-instanssista. Getdeployingin mukaan markkinalla on yli 5 100 erillistä hintapistettä, mikä selittää suuren hajonnan.

Kannattaako odottaa Rubin-sukupolven piirejä ennen investointia?
Ei välttämättä. Rubin-toimitukset ovat vasta käynnistymässä ja hinnat osittain neuvottelunvaraisia, joten monelle yritykselle B200 tai H200 tarjoaa paremman hinta-suorituskykysuhteen lähikuukausina.