Invinite Data Stack

Moderni tietoalusta.
Teidän ympäristössänne.
Teidän hallinnassanne.

Invinite Data Stack on avoimiin teknologioihin perustuva lakehouse-alusta tietotuotantoon, analytiikkaan ja tekoälyyn. Samaa arkkitehtuuria voi ajaa omassa konesalissa, yksityisessä pilvessä, eurooppalaisessa pilvessä tai hybridinä ilman, että kriittinen tietotuotanto sidotaan yhteen alustatoimittajaan.

Useimmat tietoalustat ratkaisevat eri ongelman

Useimmat tietoalustat on suunniteltu yhden pilven ja yhden toimittajan ympäristöön. Ne toimivat hyvin siihen asti, kun data on sensitiivistä, sääntely muuttuu tai hinta nousee. Silloin vaihtoehtoja ei ole, koska tietotuotanto on sidottu alustaan.

Invinite Data Stack ratkaisee toisen ongelman: miten saada modernin pilvialustan kyvykkyydet niin, että data, infrastruktuuri ja operointi pysyvät teidän päätettävissänne ja ympäristön voi vaihtaa myöhemmin.

Määräysvalta jää teille

Te päätätte, missä data sijaitsee, kuka alustaa operoi ja kuka sitä kehittää. Toimittajan voi vaihtaa ilman, että data tai tietotuotanto rakennetaan uudelleen.

Sama arkkitehtuuri joka ympäristössä

Oma konesali, yksityinen pilvi, eurooppalainen pilvi tai julkinen pilvi: toiminnallisuus ei kavennu, ja ympäristön voi vaihtaa siirtämällä työkuorman, ei koko alustaa.

Koko tietotuotanto, ei vain tallennus

Lähteistä raportointiin, jakamiseen ja tekoälyyn samasta tietopohjasta, tietoturva ja jatkuvuus rakenteessa.

Avoimet standardit, vaihdettavat osat

Data avoimessa muodossa objektitallennuksessa ja katalogi avoimen rajapinnan takana, joten laskentamoottorin voi vaihtaa datan pysyessä paikallaan.

Suvereniteetti on enemmän kuin datan sijainti.

Suvereeni tietoalusta tarkoittaa tietoalustaa, jossa organisaatio päättää itse, missä data sijaitsee, millä infrastruktuurilla ja teknologioilla sitä käsitellään, kuka alustaa operoi ja kuka sitä voi kehittää. EU:ssa sijaitseva konesali ei vielä tarkoita, että määräysvalta olisi teillä. Invinite Data Stackissa määräysvalta koskee viittä asiaa: dataa, infrastruktuuria, teknologiaa, operointia ja toimittajaa. Jokaisesta päätätte te.

Data

Te päätätte, missä data sijaitsee. Raakadata voidaan pitää kokonaan omassa ympäristössänne, eri käyttötapauksille voidaan asettaa eri suojaustasot, ja data säilyy avoimissa formaateissa, joita muutkin työkalut lukevat.

Infrastruktuuri

Alusta asennetaan omaan konesaliin, yksityiseen pilveen, eurooppalaiseen pilveen tai julkiseen pilveen ja tarvittaessa verkosta eristettyyn ympäristöön (air-gapped). Ympäristön voi vaihtaa myöhemmin ilman, että tietotuotanto rakennetaan uudelleen.

Teknologia

Alusta perustuu avoimiin standardeihin ja vaihdettaviin komponentteihin. Laskentamoottori valitaan käyttötapauksen mukaan, ja yksittäisen teknologian voi vaihtaa uusimatta koko alustaa.

Operointi

Infrastruktuuri kuvataan koodina, muutokset kulkevat versionhallinnan sekä automaattisen testauksen ja julkaisun (CI/CD) kautta, ja identiteetti, lokit, valvonta ja salaisuuksien hallinta ovat osa rakennetta. Alustaa operoi Invinite, oma tiiminne tai molemmat yhdessä.

Toimittaja

Infrastruktuurin määrittelyt ja tietotuotannon toteutus ovat teidän. Kehitystä voi jatkaa Invinite, oma tiiminne tai toinen kumppani, eikä datanne käyttö riipu yhden toimittajan suljetusta ympäristöstä.

Sama arkkitehtuuri omassa konesalissa, yksityisessä pilvessä ja julkisessa pilvessä

Invinite Data Stack toimii samalla tavalla riippumatta siitä, mihin se asennetaan: omaan konesaliin, yksityiseen pilveen, eurooppalaiseen pilveen, julkiseen pilveen tai näiden yhdistelmään. Toiminnallisuus ei kavennu missään ympäristössä.

Siksi ympäristö voi muuttua ilman, että tietotuotannon perusta pitää suunnitella uudelleen. Kun sääntely, hinnat tai toimittajat muuttuvat, siirrätte työkuorman, ette koko alustaa.

Kokonainen tietotuotannon alusta

Invinite Data Stack kattaa tietotuotannon lähteistä käyttöön. Se ei ole tallennusratkaisu.

  1. Datan tuonti. Rajapinnoista, tietokannoista, tiedostoista ja tapahtumavirroista toistettavilla, konfiguroitavilla latauksilla.
  2. Avoin tallennus. Lakehouse-malli: data avoimessa muodossa objektitallennuksessa, laskenta sen päällä.
  3. Prosessointi ja mallinnus. Hajautettu tai yhden koneen laskenta käyttötapauksen mukaan, esimerkiksi Apache Sparkilla.
  4. Hallinta. Katalogi, metatiedot, identiteetti ja käyttöoikeudet yhdessä paikassa.
  5. Tietoturva. Mitoitettu suuririskisiin järjestelmiin: identiteetti, käyttöoikeudet, lokit, verkon eristys ja valvonta ovat rakenteessa koko ketjun läpi, eivät lisäosa.
  6. Kyselyt ja analyysi. SQL:llä ja notebookeissa suoraan avoimesta datasta.
  7. Raportointi. Mittaristot ja itsepalveluanalytiikka.
  8. Jakaminen. Rajapinnat ja avoimet jakamismallit kumppaneille ilman raakadatan siirtoa.
  9. Tekoäly. Data science, mallien elinkaari ja tekoälytyökalujen avoimet rajapinnat samasta tietopohjasta.

Arkkitehtuuri: avoimet standardit, vaihdettavat komponentit

Alusta rakentuu kerroksista, joissa jokainen komponentti on vaihdettavissa. Se, mikä pysyy, on avoin standardi kerrosten välissä.

KerrosMitä se tekeeAvoin standardi
TallennusTaulut ja tiedostot objektitallennuksessaApache Iceberg, Parquet
Katalogi ja hallintaTaulujen metatiedot, käyttöoikeudet ja versiotIceberg REST -katalogirajapinta
ProsessointiHajautettu ja yhden koneen laskentaPython, SQL
OrkestrointiAjastus ja riippuvuudetvaihdettava komponentti
Kyselyt ja analytiikkaSQL-kyselyt ja notebookitSQL
RaportointiMittaristot ja itsepalveluanalytiikkavaihdettava komponentti
IdentiteettiKirjautuminen ja käyttöoikeudetOIDC, SAML
InfrastruktuuriYmpäristön määrittely ja julkaisuinfrastruktuuri koodina (IaC)
ValvontaLokit, mittarit ja hälytyksetvaihdettava komponentti
TekoälytyökalutSovellusten ja agenttien rajapinnatavoimet rajapinnat

Komponenttien valinta ja täydellinen referenssiarkkitehtuuri käydään läpi arkkitehtuurikatselmuksessa.

Mitä avoimuus tarkoittaa käytännössä

Avoimen lähdekoodin lisenssi ei yksin anna liikkumavaraa. Liikkumavara syntyy neljästä asiasta: data on avoimissa formaateissa, joita muutkin moottorit lukevat; rajapinnat ovat avoimia, joten työkalun voi vaihtaa; tietotuotannon logiikka on Pythonia ja SQL:ää, jotka siirtyvät mukana; ja alustaa voi operoida ilman yhden valmistajan hallintakerrosta (control plane).

Kun nämä neljä ovat kunnossa, yksittäisen komponentin vaihto on rajattu projekti. Koko alustaa ei tarvitse uusia.

Alusta ratkaisee, missä data elää. Data as Software ratkaisee, miten sitä tuotetaan.

Data as Software on Inviniten menetelmä, jossa tietotuotanto tehdään ohjelmistokehityksen tavoin: koodina, versionhallinnassa ja testattuna. Invinite Data Stackissa se tarkoittaa, että tietoputket ja tietotuotteet ovat Git-versionhallinnassa, muutokset katselmoidaan ennen tuotantoa, testaus ja julkaisu ovat automaattisia ja datakontraktit kertovat, mitä kukin tietotuote lupaa. Testejä on neljällä tasolla: yksikkö, integraatio, hyväksyntä ja datan laatu. Jokainen muutos on jäljitettävissä, ja julkaisut ovat hallittuja.

Näin tietotuotanto on siirrettävää siinä missä alustakin: se, mitä teille rakennetaan, kulkee koodina mukananne.

Data as Software: menetelmä →

Tietoturva ja jatkuvuus ovat rakenteessa

Nämä kuuluvat jokaiseen asennukseen. Ne kuvataan koodina ja tarkistetaan ennen kuin alusta otetaan kriittiseen käyttöön.

Identiteetin- ja pääsynhallinta

Salaisuuksien hallinta

Jäljitettävyys ja lokit

Verkon eristys

Verkosta eristetty vaihtoehto

Erilliset ympäristöt kehitykselle, testaukselle ja tuotannolle

Valvonta ja hälytykset

Varmuuskopiointi ja palautus

Käyttösääntöjen automaattinen valvonta

Hallittu julkaisu ja paluu edelliseen versioon

Alusta tukee vaatimustenmukaisuutta. Se ei yksin tee organisaatiosta vaatimustenmukaista: tietosuoja- ja tietoturvatyö, riskienhallinta ja sääntelyn edellyttämät prosessit ovat edelleen organisaation omia. Alusta tekee niistä todennettavia.

Raakadata omassa ympäristössä, laskenta siellä, missä siitä on hyötyä

Koko tietotuotanto, laskenta mukaan lukien, voidaan ajaa Invinite Data Stackissa teidän valitsemassanne sijainnissa: omassa konesalissa, yksityisessä pilvessä tai julkisessa pilvessä. Hybridimalli on vaihtoehto silloin, kun osa analytiikasta ja tekoälystä halutaan nykyiselle pilvialustalle tai julkisen pilven palveluihin. Silloin se etenee kolmessa vaiheessa.

Hallittu ympäristö.

Raakadata tuodaan, pseudonymisoidaan ja mallinnetaan omassa ympäristössänne. Syntyy tietotuote ilman suoria tunnisteita.

Valitut pilvipalvelut.

Pseudonymisoitu tietotuote viedään julkiseen pilveen tai nykyiselle pilvialustallenne skaalautuvaa analytiikkaa ja tekoälyä varten.

Tulokset takaisin.

Mallit, tulokset ja aggregaatit palautetaan hallitusti omaan ympäristöön ja jaetaan sieltä.

Pseudonymisoitu data on avaimen haltijalle yhä henkilötietoa, joten rakenne ei yksin ratkaise, mitä pilveen saa viedä. Se tekee tietosuojatyöstä todennettavaa.

Kenelle alusta on rakennettu

Invinite Data Stack sopii organisaatiolle, jossa yksi tai useampi näistä pitää paikkansa:

  • data on sensitiivistä tai toiminnan kannalta kriittistä;
  • haluatte säilyttää oman operointikyvyn;
  • nykyisen pilvialustan kustannus tai riippuvuus yhdestä toimittajasta huolettaa;
  • tekoäly tarvitsee luotettavan ja koneellisesti käytettävän tietopohjan;
  • varautuminen edellyttää vaihtoehtoisia ajotapoja;
  • samaa dataa pitää käyttää useassa ympäristössä.

Toimialat: sosiaali- ja terveydenhuolto, julkishallinto, turvallisuus, kriittinen teollisuus ja tutkimus.

Korvaa valittuja kerroksia tai toimii nykyisen pilvialustan rinnalla

Invinite Data Stackia ei tarvitse valita kaiken muun tilalle. Se voi korvata nykyisestä pilvialustasta valittuja tietotuotannon kerroksia, esimerkiksi raakadatan käsittelyn, tai toimia sen rinnalla hybridimallissa.

Vertailu kategoriatasolla, tilanne 10/2026.

Hallinnoitu pilvialustaEurooppalainen sovereign cloud -alustaInvinite Data Stack
Oma konesaliTyypillisesti eiTyypillisesti eiKyllä
Yksityinen pilviRajatustiPalvelukohtaisestiKyllä
Julkinen pilviKylläKylläKyllä
Verkosta eristetty ympäristöEiHarvoinMahdollinen
Avoimet formaatitVaihteleeUseinLähtökohta
Asiakkaan hallitsema infrastruktuuri koodinaVaihteleeVaihteleeKyllä
Komponenttien vaihdettavuusRajattuRajattuSuunnitteluperiaate
Operointi omalla tiimilläRajatustiHarvoinMahdollinen

Databricks ja Snowflake ovat esimerkkejä hallinnoiduista pilvialustoista, joiden rinnalla Invinite Data Stackia voi käyttää.

Näyttö

Mihin alusta perustuu

Invinite Data Stack on tuotteistettu toteutuksista, joissa avoimen tietoalustan teknologiat ja Data as Software on viety asiakkaan omaan ympäristöön säännellyssä terveydenhuollon tietoympäristössä. Asiakaskohtaisista yksityiskohdista kerromme, kun asiakkaan lupa on kunnossa.

Lisäksi: lakehouse ja Data as Software Länsi-Uudenmaan hyvinvointialueella asiakkaan omassa julkisen pilven ympäristössä; kolme hybridipilvi- ja suvereniteettiselvitystä; [tuotantokelpoisuuden tarkistuslista](#tietoturva).

Näin alusta otetaan käyttöön

Arkkitehtuurikatselmus.

Käymme läpi nykyisen tietoalustan, datan, tietoturvan ja ympäristöt. Saatte nykytilan kuvauksen, kriittiset riippuvuudet ja yhden realistisen polun.

Kyvykkyyden osoitus tai pilotti.

Yksi rajattu toimialue tai käyttötapaus viedään läpi lähteestä käyttöön. Saatte toimivan tietotuotteen ja arvion tuotantoon viennistä.

Tuotantoalusta.

Alusta pystytetään infrastruktuuri koodina: integraatiot, identiteetti, valvonta sekä automaattinen testaus ja julkaisu. Saatte alustan, jonka määrittelyt ovat teidän.

Operointi ja siirto.

Invinite operoi, te operoitte tai teemme sen yhdessä. Osaaminen ja toteutus siirtyvät teille työn aikana.

Alusta ostetaan projektina tai jatkuvana allokaationa. Katselmus on rajattu projekti.

Usein kysyttyä

Mitä suvereeni tietoalusta tarkoittaa?

Tietoalustaa, jossa määräysvalta on organisaatiolla viidessä asiassa: missä data sijaitsee, millä infrastruktuurilla alusta ajetaan, mihin teknologioihin se perustuu, kuka sitä operoi ja kuka sitä voi kehittää. EU:ssa sijaitseva konesali ei täytä tätä, jos alustan hallintakerros on yhden toimittajan käsissä.

Onko Invinite Data Stack pilvipalvelu?

Ei. Se on alusta, joka asennetaan teidän valitsemaanne ympäristöön: omaan konesaliin, yksityiseen pilveen, julkiseen pilveen tai näiden yhdistelmään. Sitä ei osteta SaaS-palveluna yhdeltä pilvitoimittajalta.

Voiko sen asentaa omaan konesaliin?

Kyllä. Oma konesali on yksi alustan tavallisista ympäristöistä, ja toiminnallisuus on sama kuin pilvessä. Alusta pystytetään infrastruktuuri koodina, joten asennus on toistettavissa.

Näytä kaikki kysymykset (12)

Voiko se toimia verkosta eristetyssä ympäristössä?

Kyllä. Oman ympäristön osa voidaan eristää verkosta kokonaan (air-gapped). Se edellyttää, että pakettien jakelu, päivitykset ja valvonta järjestetään eristetyn ympäristön ehdoilla. Tämä suunnitellaan katselmuksessa.

Korvaako se Databricksin tai Snowflaken?

Se voi korvata niistä valittuja tietotuotannon kerroksia, esimerkiksi raakadatan käsittelyn ja tallennuksen, mutta ei pakota siihen. Moni organisaatio pitää nykyisen pilvialustan analytiikkaan ja tekoälyyn ja siirtää raakadatan käsittelyn omaan ympäristöönsä.

Voiko sitä käyttää Databricksin tai Snowflaken rinnalla?

Kyllä. Hybridimallissa raakadata käsitellään ja pseudonymisoidaan Invinite Data Stackissa omassa ympäristössänne, ja pseudonymisoitu tietotuote viedään nykyiselle pilvialustalle. Tulokset palautetaan hallitusti.

Mihin avoimiin standardeihin alusta perustuu?

Taulut tallennetaan Apache Iceberg -muodossa ja tiedostot Parquet-muodossa, katalogi toimii avoimen Iceberg REST -rajapinnan kautta, tietotuotanto kirjoitetaan Pythonilla ja SQL:llä, ja infrastruktuuri kuvataan koodina. Komponentit ovat vakiintuneita avoimen lähdekoodin projekteja, ja käymme ne läpi arkkitehtuurikatselmuksessa.

Mihin muotoon tiedot tallennetaan?

Apache Iceberg -tauluihin ja Parquet-tiedostoihin objektitallennuksessa. Molemmat ovat avoimia formaatteja, joita useat moottorit ja työkalut lukevat, joten data ei ole sidottu alustaan.

Kuka operoi alustaa?

Te valitsette: Invinite operoi, oma tiiminne operoi tai teemme sen yhdessä. Koska infrastruktuuri on koodina ja dokumentaatio on teidän, operoinnin voi siirtää vaiheittain omalle tiimille tai toiselle kumppanille.

Miten päivitykset toteutetaan?

Muutokset tehdään infrastruktuurin koodiin, katselmoidaan ja viedään tuotantoon hallitulla julkaisulla. Jos jokin menee pieleen, edelliseen versioon palataan samalla mekanismilla. Verkosta eristetyssä ympäristössä päivitykset tuodaan erikseen sovitulla tavalla.

Miten alusta tukee GDPR:n, NIS2:n, EHDS:n ja toisiolain vaatimuksia?

Rakenne tukee osoitusvelvollisuutta: raakadata voidaan pitää omassa ympäristössä, käyttö on jäljitettävissä ja pääsy on hallittua. Toisiolain nojalla luovutettu aineisto käsitellään auditoidussa tietoturvallisessa käyttöympäristössä, ja EHDS eli eurooppalainen terveystietoalue tuo omat vaatimuksensa tiedon toisiokäytölle. Alusta ei yksin tee organisaatiosta vaatimustenmukaista, mutta se tekee tietosuoja- ja tietoturvatyöstä todennettavaa.

Miten Invinite Data Stack liittyy Data as Softwareen?

Alusta ratkaisee, missä data sijaitsee ja millä teknologioilla sitä käsitellään. Data as Software ratkaisee, miten sitä tuotetaan: koodina, versionhallinnassa, testattuna ja datakontrakteilla kuvattuna. Alusta toimitetaan menetelmän kanssa, ja yhdessä ne tekevät tietotuotannosta siirrettävää.

Miltä suvereeni tietoalusta näyttäisi teidän ympäristössänne?

Arkkitehtuurikatselmus on rajattu katselmus, jollaisia olemme tehneet useille organisaatioille. Käymme läpi nykyisen tietoalustan, kriittiset riippuvuudet ja yhden realistisen polun hybridin tai suvereenin ympäristön toteuttamiseen. Katselmuksessa näytämme myös referenssiarkkitehtuurin komponentteineen.

Liittyvät sivut: Data as Software · Määrittely ennen hankintaa