Grazie per aver inviato la tua richiesta! Uno dei nostri team membri ti contatterà a breve.
Grazie per aver inviato il tuo prenotazione! Uno dei nostri team membri ti contatterà a breve.
Struttura del corso
Introduzione ad Apache Iceberg
- Panoramica generale su Apache Iceberg
- Importanza e casi d’uso nell’architettura moderna dei dati
- Caratteristiche principali e vantaggi offerti
Concetti fondamentali
- Il formato tabellare Iceberg e la sua architettura
- Confronto con altri formati tabellari
- Partizionamento e evoluzione degli schemi
- Funzionalità di “time travel” e gestione delle versioni dei dati
Configurazione iniziale di Apache Iceberg
- Installazione e configurazione di base
- Integrazione con i principali motori di elaborazione dati
- Configurazione dell’ambiente Iceberg su un computer locale
Operazioni di base
- Creazione e gestione delle tabelle Iceberg
- Scrittura e lettura dei dati dalle tabelle Iceberg
- Operazioni di base di inserimento, aggiornamento ed eliminazione
Migrazione e integrazione dei dati
- Trasferimento dei dati da Hive e altri sistemi ad Apache Iceberg
- Integrazione con strumenti di business intelligence
- Migrazione pratica di un dataset campione verso Iceberg
Ottimizzazione delle prestazioni
- Tecniche di ottimizzazione prestazionale
- Strategie per migliorare le interrogazioni e l’indagine dei dati
- Ottimizzazione delle performance all’interno di Apache Iceberg
Panoramica sulle funzionalità avanzate
- Evoluzione dei partizionamenti e partizionamento “nascosto”
- Evoluzione delle tabelle e modifiche agli schemi
- Funzionalità di “time travel” e annullamento delle modifiche
- Implementazione pratica delle funzionalità avanzate in Apache Iceberg
Conclusioni e prossimi passi
Requisiti
- Conoscenza di concetti come tabelle, schemi, partizionamento e importazione dei dati
- Conoscenze di base di SQL
Destinatari
- Ingegneri dei dati
- Architetti di sistemi di dati
- Analisti di dati
- Sviluppatori software
14 ore
Recensioni (2)
Un viaggio attraverso il mondo di Spark: un corso molto intenso. DSL, Spark SQL, partizionamento rispetto al bucketing per me.
Georgiana Elisabeta
Corso - Apache Spark Fundamentals
Traduzione automatica
Esercizi pratici. La classe sarebbe dovuta durare 5 giorni, ma i 3 giorni sono stati sufficienti per chiarire molte delle domande che avevo lavorando con NiFi.
James - BHG Financial
Corso - Apache NiFi for Administrators
Traduzione automatica