Muistiinpano
Tämän sivun käyttö edellyttää valtuutusta. Voit yrittää kirjautua sisään tai vaihtaa hakemistoa.
Tämän sivun käyttö edellyttää valtuutusta. Voit yrittää vaihtaa hakemistoa.
Microsoft OneLake on yhtenäinen datajärvi koko organisaatiollesi. Jokainen Microsoft Fabric -vuokralainen sisältää automaattisesti OneLaken, ja se on ainoa paikka kaikelle analytiikkadatallesi. Se on keskitetty tietovarasto, jossa voit tallentaa, hallita ja hallita kaikkea dataa analytiikka- ja tekoälytyökuormia varten koko organisaatiossa.
OneLake perustuu Azure Data Lake Storage -järjestelmään ja tallentaa taulukot Delta Parquet- tai Iceberg-muodossa, kahdessa avoimessa standardissa, joita mikä tahansa työkalu voi lukea. Tämä lähestymistapa tarkoittaa, ettei datasi ole lukittu omiin muotoihin.
OneLake tarjoaa:
- Yhtenäinen datan tallennus koko organisaatiolle, jossa on sisäänrakennettu hallinto ja turvallisuus
- Yksi datakopio käytettäväksi useilla analytiikkamoottoreilla ilman päällekkäisyyttä
- Joustava yhteys tiedostonhallintaohjelman, ADLS Gen2 -rajapintojen ja Azure-palveluintegraatioiden kautta
- Tietosuoja ja valvonta sisäänrakennetulla redundanssilla, katastrofipalautuksella ja pääsyn diagnostiikoilla
Yhtenäinen tietovarastointi
Ennen OneLakea organisaatiot loivat usein useita järviä eri liiketoimintaryhmille, mikä johti ylimääräiseen ylimääräiseen kuormaan useiden resurssien hallinnassa. Tämä eristetty lähestymistapa vaikeutti tiimien välistä yhteistyötä, hidasti dataprojekteja ja lisäsi päällekkäisyyksien riskiä.
OneLake ratkaisee nämä haasteet tarjoamalla sinulle koko organisaatiolle keskitetyn datan käyttöpisteen. Jokaisella Fabric-vuokralaisella on yksi OneLake-instanssi. Et voi poistaa OneLakea tai luoda useita OneLakeja, eikä infrastruktuuria ole tarjottavaksi tai hallinnoitavaksi. Osastot, tiimit ja projektit voivat tallentaa tai yhdistää tietonsa tähän yhtenäiseen järveen ja järjestää sen Fabric-domaineilla, alidomaineilla ja työtiloilla – jokaisella oma ylläpitäjänsä. Tämä malli ylläpitää datan omistajuutta ja mahdollistaa liittoutuneen hallinnan, samalla kun valtuutetut käyttäjät voivat löytää ja käyttää dataa ilman kitkaa.
Keskitetysti hallinnoitu ja hajautettu omistus
Fabric-data kuuluu seuraavaan organisaation ja hallinnon hierarkiaan:
- Vuokralainen: Vuokralaistason käytännöt suojaavat automaattisesti kaikki OneLakeen päätyvät tiedot turvallisuuden, vaatimustenmukaisuuden ja tietojen hallinnan varmistamiseksi.
- Työtila: Voit luoda vuokralaiseen minkä tahansa määrän työtiloja järjestääksesi tietosi. Työtilojen avulla organisaation eri osat voivat jakaa omistajuus- ja käyttöoikeuskäytäntöjä. Jokainen työtila on osa kapasiteettia, joka on sidottu tiettyyn alueeseen ja laskutetaan erikseen.
- Tietokohteet: Työtilat sisältävät tietokohteita, kuten järvitaloja, varastoja, tapahtumapaikkoja ja KQL-tietokantoja. Jokainen tuotetyyppi on suunniteltu erityisesti tiettyihin työkuormiin, kuten Spark-pohjaiseen analytiikkaan, T-SQL-kyselyihin, reaaliaikaiseen suoratoistoon.
Lisätietoja on kohdassa Työtilat.
Tutustu ja hallitse OneLake-katalogin avulla
OneLake-katalogi on ainoa paikka, jossa data-ammattilaiset ja yrityskäyttäjät voivat löytää, hallita ja hallita omistamiaan ja saatavilla olevia tietojaan OneLaken alueella.
Käyttäjät voivat suodattaa toimialueen, työtilan, kohdetyypin, hyväksyntöjen ja muiden mukaan löytääkseen juuri tarvitsemansa kohteen, ja jokainen tietokohde rikastetaan metatiedoilla, kuten kuvauksilla, omistajilla, skeemalla, sukulinjalla ja käyttömittareilla.
Datan omistajat voivat saada oivalluksia ja suositeltuja toimenpiteitä datan laadun ja vaatimustenmukaisuuden parantamiseksi, mukaan lukien näkyvyys herkkyysetikettien kattavuuteen, tunnisteisiin, hyväksyntöihin ja tietojen sijaintiin.
Lisätietoja löytyy OneLake-katalogista.
Suojaus
OneLaken tietoturvamalli mahdollistaa tiedon jakamisen laajasti paljastamatta arkaluontoista tietoa. Käyttämällä OneLake-tietoturvarooleja voit määritellä yksityiskohtaisia käyttöoikeuksia tietokohteisiin, aina tiettyihin kansioihin, tauluihin tai jopa riveihin ja sarakkeisiin. Esimerkiksi voisit jakaa myyntidatan tiimille, mutta rajoittaa pääsyä sarakkeeseen Cost , tai voit sallia kumppanin nähdä vain rivejä, joissa Region = "US". OneLake tallentaa nämä roolit ja valvoo niitä automaattisesti kaikissa analytiikkakokemuksissa. Joten jos käyttäjällä on pääsy vain osaan aineistosta, sääntö pätee riippumatta siitä, kysyy hän SQL:n kautta, ajaa Spark-muistikirjaa tai katsoo Power BI-raporttia. OneLake varmistaa, että he näkevät vain sen, mitä he saavat nähdä.
Tämä yhtenäinen turvallisuuslähestymistapa tarkoittaa, ettei käyttäjien tarvitse ylläpitää erillisiä käyttöoikeuksia eri moottoreiden välillä. Se tarkoittaa myös, että alkuperäiset datanomistajat pitävät aina hallinnan siitä, kuka pääsee käsiksi tietolähteeseen, vaikka data siirtyisi jonkun toisen omistamaan järvimajaan tai työtilaan.
Voit soveltaa herkkyysetikettejä OneLake-kohteisiin samalla tavalla kuin asiakirjaan, ja nämä etiketit valvovat salauksen tai pääsyrajoituksia, vaikka data vietettäisiin Exceliin tai muuhun työkaluun. Samoin tietojen häviöiden ehkäisykäytännöt (DLP) voivat havaita arkaluonteiset tiedon lataukset tai lataukset OneLakesta ja estää tai varoittaa mahdollisista tietovuodoista.
Lisätietoja löytyy kohdasta Aloita tietojesi suojaaminen OneLakessa.
Yksi tietojen kopio
Kaikki Fabric-analytiikkamoottorit työskentelevät datan kanssa suoraan OneLakessa. Sinun ei tarvitse kopioida dataa käyttääksesi sitä toisessa moottorissa tai analysoidaksesi dataa useista lähteistä.
Shortcuts
Pikakuvake on viittaus muihin tiedostosijainteihin tallennettuihin tietoihin. Nämä tiedostojen sijainnit voivat olla samassa työtilassa, eri työtilassa OneLakessa tai OneLaken ulkopuolella. Voit käyttää pikakuvakkeita OneLake-, Azure Data Lake Storage-, Azure Blob -tallennus-, Amazon S3- ja S3-yhteensopiville lähteille, Iceberg-yhteensopiville lähteille, Microsoft Dataverse:lle, paikallisille lähteille ja muille. Sijainnista riippumatta pikakuvakkeiden avulla tiedostot ja kansiot näyttävät siltä, että ne on tallennettu paikallisesti.
Pikakuvakkeet mahdollistavat tiedon yhdistämisen pilvien ja verkkotunnusten välillä ilman, että sitä tarvitsee kopioida. Tiimit voivat työskennellä itsenäisesti erillisissä työtiloissa ja käyttää pikakuvakkeita jakaakseen dataa keskenään sen sijaan, että ne kopioisivat sitä. Esimerkiksi yksi tiimi voisi luoda pikakuvakkeen toisen tiimin työtilaan tai ulkoiseen S3-bucketiin ja yhdistää sen datan omaansa OneLakessa. Pikakuvake osoittaa lähteeseen, joten kun lähdedata päivittyy, muutokset näkyvät välittömästi OneLaken kautta. Näin voit luoda virtuaalisia tuotteita tai näkymiä, jotka kokoavat tietoja useista liiketoimintaryhmistä tiettyyn tarpeeseen vastaamaan ilman, että dataa siirretään tai kopioidaan. Pikakuvakemuunnoksilla voit jopa tehdä automaattisia muutoksia dataan, kuten muuntaa tietomuodon tai poistaa henkilötietoja (PII).
Lisätietoja pikakuvakkeiden käyttämisestä on artikkelissa OneLake-pikakuvakkeet.
Mirroring
Mirroring in Fabric on edullinen ja matalaviiveinen ratkaisu, joka jatkuvasti kopioi dataa eri järjestelmistä OneLakeen. Voit turvallisesti yhdistää ulkoiseen tietolähteeseen ja automaattisesti peilata (kopioida) valitut tietokannat tai taulukot OneLaken avoimeen formaattiin, pitäen ne synkassa lähes reaaliajassa. Peilattu data tallennetaan Delta Parquetina OneLakeen, joten se on välittömästi valmis analysoitavaksi mille tahansa Fabric-moottorille.
Peilaus tukee lähteitä kuten Azure SQL Database, Azure Cosmos DB, Azure Database for PostgreSQL, Azure Databricks (Unity Catalog), Snowflake ja muita. Lähdekoodin muutokset leviävät jatkuvasti, joten OneLake-kopiosi pysyy up-to-ajankohtaisena ilman manuaalisia ETL-töitä. Voit ajaa analytiikkaa, tekoälyä tai Power BI -raportteja tuoreesta datasta ilman, että sinun tarvitsee suoraan kysyä tuotantolähteestä.
Lisätietoja löytyy kohdasta What is mirroring in Fabric?
Tee yhteistyötä useissa analyyttisissa moottoreissa
Fabric-analytiikkamoottorit (T-SQL, Apache Spark, Analysis Services ja muut) tallentavat tiedot OneLakeen avoimessa Delta Parquet -muodossa. Tämä standardisointi mahdollistaa saman datan käytön useissa moottoreissa. Sinun ei tarvitse kopioida dataa vain käyttääksesi sitä toisen moottorin kanssa tai tuntea olevasi jumissa tietyn moottorin kanssa, koska datasi ovat siellä.
Esimerkiksi SQL-insinööritiimi rakentaa täysin transaktioisen tietovaraston. He käyttävät T-SQL-moottoria taulujen luomiseen, datan muuntamiseen ja datan lataamiseen tauluihin. Jos data-analyytikko haluaa hyödyntää tätä dataa, hän voi liittää Spark-muistikirjan OneLakeen ja lukea taulukot suoraan. Koska OneLake tallentaa taulukot Delta-muodossa, Spark voi ladata ne ilman erityisiä liittimiä tai datan vientiä. Sekä SQL-kyselyt että Spark-työt toimivat OneLaken datan yhdellä kopiolla.
Lisäksi yrityskäyttäjät voivat rakentaa Power BI -raportteja OneLaken päälle käyttämällä Analysis Services -moottorin Direct Lake -tilaa. Direct Lake -tila on datan käyttötila, joka lataa ja päivittää suuria määriä dataa nopeasti ilman, että tarvitsee tehdä kopioita. Lisätietoja on kohdassa Direct Laken yleiskatsaus.
Avoimen taulukon muodon yhteensopivuus
OneLake tukee sekä Delta Lake- että Apache Iceberg -taulukkomuotoja metatietojen virtualisoinnin kautta. Tämä ominaisuus generoi automaattisesti virtuaalisia metatietoja, jotta Iceberg-taulukot voidaan lukea Delta Lake -tauluina Fabric-työkuormien yli, ja Delta Lake -taulukoita voidaan lukea ulkoisilla Iceberg-lukijoilla. Voit kirjoittaa Iceberg-taulukoita suoraan OneLakeen tai luoda oikoteitä ulkoisesti tallennettaviin Iceberg-tauluihin, ja OneLake tekee ne saataville kaikille Fabric-moottoreille ilman manuaalista muunnosta. Samoin mihin tahansa Delta Laken pöytään OneLakessa pääsee Iceberg-yhteensopivilla palveluilla, kuten Snowflakella.
Lisätietoja on kohdassa Iceberg-taulukoiden käyttäminen OneLaken kanssa.
Yhdistä OneLakeen
Voit käyttää OneLake-dataa Fabric-portaalista, Windows-ohjelmasta, olemassa olevista Azure-työkaluista tai mistä tahansa sovelluksesta, joka tukee ADLS Gen2 -rajapintoja.
OneLake-resurssienhallinta Windowsille
Voit tutkia OneLake-dataa Windows:sta käyttämällä OneLake-tiedostonhallintaohjelmaa Windows -ohjelmassa. Voit siirtyä kaikissa työtiloissa ja tietokohteissa, ladata, ladata tai muokata tiedostoja helposti samalla tavalla kuin Officessa. OneLake-tiedostonhallintajärjestelmä yksinkertaistaa datajärvien kanssa työskentelyä, joten myös ei-tekniset yrityskäyttäjät voivat käyttää niitä.
Lisätietoja on artikkelissa OneLake-resurssienhallinta.
ADLS Gen2 API:t ja SDK:t
OneLake tukee Azure Data Lake Storage (ADLS) Gen2 -rajapintoja ja SDK:ita, joten voit käyttää olemassa olevia ADLS Gen2 -sovelluksia. Jokainen työtila näkyy konttina, ja tietokohteet näkyvät kansioina näissä säiliöissä. Lisätietoja on artikkelissa OneLaken käyttö ja ohjelmointirajapinnat.
Koska OneLake on yhteensopiva ADLS Gen2 -sovellusten kanssa, voit yhdistää OneLakeen Azure-palveluista. Esimerkkejä:
- Azure Synapse Analytics
- Azure Storage Explorerin
- Azure Databricks
- Microsoft Foundry
Tietosuoja ja valvonta
OneLake sisältää sisäänrakennetut ominaisuudet, jotka pitävät tietosi turvassa ja antavat näkyvyyden siihen, miten niitä käytetään.
Katastrofipalautus ja tietosuoja
OneLake suojaa dataasi automaattisesti sisäänrakennetulla redundanssilla. Alueilla, jotka tukevat saatavuusalueita, OneLake käyttää vyöhykeredundanttitallennusta (ZRS) datan replikointiin useiden datakeskusten välillä. Toisilla alueilla se käyttää paikallisesti redundanttia tallennusta (LRS). Lisäsuojaa alueellisia katkoja vastaan voit ottaa käyttöön liiketoiminnan jatkuvuuden ja katastrofipalautuksen (BCDR) kyvyssä, jolla datasi voidaan georeplikoida paritettuun Azure-alueeseen. OneLake tukee myös pehmeää poistoa, joka säilyttää poistetut tiedostot seitsemän päivää, jotta voit palauttaa vahingossa tapahtuneet poistot.
Lisätietoja löytyy kohdasta Katastrofipalautus ja tietosuoja OneLakelle.
Diagnostiikka
OneLake-diagnostiikka tarjoaa näkyvyyttä siihen, miten dataa käytetään ja käytetään Fabric-ympäristössäsi. Kun otat diagnostiikan käyttöön työtilatasolla, se lähettää datan käyttötapahtumat lokkeina järventaloon. Voit seurata, kuka on käyttänyt mitäkin dataa, milloin ja miten. Tämä lokitus kattaa käyttäjän toiminnot Fabric UI:ssa, ohjelmallisen pääsyn API:n ja analytiikkamoottoreiden kautta sekä työtilan välisen pääsyn pikanäppäimillä.
Lisätietoja on kohdassa OneLake-diagnostiikka.