ELT adalah singkatan dari extract, load, transform. Proses ini membalikkan urutan ETL tradisional. Data diekstrak dari sumber dan dimuat langsung ke sistem target dalam bentuk mentah. Transformasi terjadi di dalam target, biasanya gudang data cloud, menggunakan daya komputasinya. Pendekatan ini menjadi populer seiring dengan peningkatan skala gudang data cloud dan penurunan biaya pemrosesannya. Mengapa melakukan transformasi di server terpisah jika gudang data dapat melakukannya lebih cepat dan lebih murah?
ELT memiliki beberapa keunggulan. Data mentah disimpan di gudang data, sehingga transformasi dapat dijalankan ulang tanpa perlu mengekstrak ulang dari sumber. Transformasi baru dapat diterapkan secara retroaktif. Sistem target menangani pekerjaan berat, yang menyederhanakan arsitektur pipeline. Alat seperti dbt membawa praktik rekayasa perangkat lunak ke transformasi: kontrol versi, pengujian, dokumentasi, dan kode modular. Kelemahannya adalah gudang data harus cukup kuat untuk menangani penyimpanan dan transformasi. Ini juga berarti data mentah yang berpotensi sensitif berada di gudang data sebelum transformasi. Kontrol akses harus melindunginya. ELT tidak selalu lebih baik daripada ETL. Untuk beberapa beban kerja, transformasi sebelum pemuatan mengurangi volume data yang mencapai gudang data. Untuk yang lain, fleksibilitas ELT lebih unggul. Pilihan tergantung pada kemampuan sistem target dan preferensi tim.
Karakteristik ELT
- Muat data mentah — data masuk ke gudang data tanpa diubah.
- Transformasi di tempat — komputasi gudang menangani transformasi
- Dapat diproses ulang — transformasi dapat dijalankan kembali pada data mentah.
- Saluran pipa yang lebih sederhana — lebih sedikit komponen bergerak.
- Bergantung pada gudang data — membutuhkan komputasi yang skalabel.
ELT adalah ETL yang dibalik. Gudang data yang melakukan pekerjaannya. Pipeline hanya memindahkan data.
Comments
No comments yet. Be the first to share a thought.
Leave a comment