Muistiinpano
Tämän sivun käyttö edellyttää valtuutusta. Voit yrittää kirjautua sisään tai vaihtaa hakemistoa.
Tämän sivun käyttö edellyttää valtuutusta. Voit yrittää vaihtaa hakemistoa.
Microsoft Fabric Data Engineering mahdollistaa käyttäjille infrastruktuurien ja järjestelmien suunnittelun, rakentamisen ja ylläpidon, joiden avulla organisaatiot voivat kerätä, tallentaa, käsitellä ja analysoida suuria määriä dataa.
Fabric tarjoaa erilaisia data-insinöörin ominaisuuksia varmistaakseen, että tietosi ovat helposti saatavilla, hyvin organisoituja ja laadukkaita. Jos haluat päästä tietotekniikan aloitussivulle, valitse siirtymisruudusta Kuormitukset ja valitse sitten Data Engineering - ruutu. Tietotekniikan aloitussivulta voit tehdä seuraavat toiminnot:
Luo ja hallitse tietojasi Lakehouse-tallennustilan avulla
Suunnittele putkia tietojen kopioimiseksi Lakehouse-tallennustilaan
Erä-/virtautustyön lähettäminen Spark-klusteriin Spark-työmääritysten avulla
Käytä muistikirjoja koodin kirjoittamiseen tietojen käsittelystä, valmistelusta ja muuntamisesta
Lakehouse
Lakehouse-talot ovat tietoarkkitehtuureja, joilla organisaatiot voivat tallentaa ja hallita jäsennettyjä ja jäsentämättömiä tietoja yhteen sijaintiin käyttäen erilaisia työkaluja ja sovelluskehyksiä tietojen käsittelemiseen ja analysointiin. Nämä työkalut ja sovelluskehykset voivat sisältää SQL-pohjaisia kyselyitä ja analyyseja sekä koneoppimista ja muita edistyneitä analytiikkatekniikoita.
Apache Spark -työn määritelmä
Spark-työmääritykset ovat ohjejoukko, joka määrittää, miten työ suoritetaan Spark-klusterissa. Se sisältää tietoja, kuten syötteen ja tulosteen tietolähteet, muunnokset ja Spark-sovelluksen määritysasetukset. Spark-työn määrityksen avulla voit lähettää erä- tai suoratoistotyön Spark-klusteriin, soveltaa eri muunnoslogiikkaa Lakehousessa isännöityihin tietoihin monien muiden asioiden ohella.
Muistikirja
Muistikirjat ovat vuorovaikutteinen tietojenkäsittelyympäristö, jossa käyttäjät voivat luoda ja jakaa asiakirjoja, jotka sisältävät reaaliaikaista koodia, yhtälöitä, visualisointeja ja selostustekstiä. Niiden avulla käyttäjät voivat kirjoittaa ja suorittaa koodia eri ohjelmointikielissä, kuten Pythonissa, R:ssä ja Scalassa. Voit käyttää muistikirjoja tietojen käsittelyyn, valmisteluun, analysointiin ja muihin tietoihin liittyviin tehtäviin.
Pipeline
Putket ovat sarja vaiheita, joiden avulla voidaan kerätä, käsitellä ja muuntaa tietoja raakamuodosta muotoon, jota voit käyttää analysointiin ja päätöksentekoon. Ne ovat tärkeä osa tietotekniikkaa, koska ne tarjoavat tavan siirtää tietoja lähteestä kohteeseensa luotettavalla, skaalattavalla ja tehokkaalla tavalla.
Voit käyttää Data Engineeringiä ilmaiseksi, kun rekisteröidyt Fabric-kokeiluun. Voit myös ostaa Fabric-kapasiteetin tai Fabric-varatun kapasiteetin
Aiheeseen liittyvä sisältö
Aloita tietotekniikka:
- Lisätietoja järvenmökeistä löydät kohdasta Mikä on järvenrakennus Fabric-alueella?
- Jos haluat aloittaa järvimajan kanssa, katso Luo järvitalo Fabric-sivustolla.
- Lisätietoja Apache Spark -työn määritelmistä on artikkelissa Mikä Apache Spark -työmääritelmä on?
- Jos haluat aloittaa Apache Spark -työmääritelmän käytön, katso Apache Spark -työmääritelmän luominen Fabric.
- Lisätietoja muistikirjoista on artikkelissa Muistikirjan luominen ja suorittaminen.
- Jos haluat aloittaa jakson kopiointitoiminnon käytön, katso Tietojen kopiointi toimintojen kopioimisenavulla.