Wprowadzenie
Trino (dawniej PrestoSQL) to rozproszony silnik zapytań SQL, który pozwala analizować dane tam, gdzie się znajdują, bez ich kopiowania i bez procesów ETL. Jednym zapytaniem można sięgać do wielu różnych źródeł: systemów plików Hadoop i magazynów obiektowych, relacyjnych baz danych, a także systemów strumieniowych. Popularność Trino w środowiskach analitycznych, integracja z narzędziami BI oraz duża liczba dostępnych złączy sprawiają, że jest jednym z ważniejszych elementów współczesnych platform danych.
Szkolenie Trino – wprowadzenie prezentuje architekturę Trino oraz jego praktyczne wykorzystanie do analizy danych.
Podstawowe cele szkolenia
- Poznanie podstawowej architektury Trino: koordynatora, węzłów roboczych i złączy (connectors)
- Uruchomienie Trino lokalnie oraz wykonywanie zapytań SQL do różnych źródeł danych, w tym zapytań łączących dane z wielu z nich
Główne jego zalety
- Kompleksowe wprowadzenie do Trino – po zakończonym szkoleniu wiesz, czym różni się od klasycznych baz danych i od Hive oraz kiedy warto po nie sięgnąć
- Przedstawienie praktycznych przykładów: federacja danych, praca z interfejsem webowym, analiza planów i etapów wykonania zapytań oraz zaawansowane konstrukcje SQL
- Praktyka przed teorią – nie tylko wiesz jak, ale także dlaczego
Dla kogo?
Programiści i analitycy, którzy znają podstawy Big Data oraz hurtowni danych i chcą rozpocząć przygodę z wykorzystaniem silnika Trino do analizy danych z wielu źródeł
Wymagania
- Dobra znajomość języka SQL oraz relacyjnego modelu danych
- Znajomość zagadnień Big Data i hurtowni danych
- Ogólna orientacja w narzędziach ekosystemu Hadoop, w szczególności w Hive
- Podstawowa umiejętność pracy z wierszem poleceń
Materiały szkoleniowe
- Prezentacja
- Warsztat