Trang chủ
Khoá học
Về chúng tôi
Blog
Liên hệ
Apache Spark cho người mới: Pipeline CSV đến Parquet
20
Sep, 26
Apache Spark cho người mới sẽ dễ hiểu hơn khi
Read More
PySpark DataFrame: Xử lý JSON lồng nhau
20
Sep, 26
PySpark DataFrame đặc biệt hữu ích khi dữ liệu JSON
Read More
Spark SQL thực chiến: Xây Data Mart doanh thu
20
Sep, 26
Spark SQL thực chiến không chỉ là chuyển một câu
Read More
Join trong Apache Spark: Tối ưu đơn hàng và khách hàng
20
Sep, 26
Join trong Apache Spark có thể biến một pipeline vài
Read More
Window Function trong PySpark: Phân tích khách hàng
20
Sep, 26
Window Function trong PySpark cho phép tính toán theo nhóm
Read More
Data Quality với PySpark: Kiểm tra và cách ly dữ liệu lỗi
20
Sep, 26
Data Quality với PySpark cần được thiết kế như một
Read More
Incremental Processing với Spark: Chỉ xử lý dữ liệu mới
20
Sep, 26
Incremental Processing với Spark giúp giảm lượng dữ liệu phải
Read More
Apache Spark JDBC: Kết nối PostgreSQL an toàn
20
Sep, 26
Apache Spark JDBC có thể đọc PostgreSQL song song, nhưng
Read More
Small Files trong Spark: Phát hiện và tối ưu
20
Sep, 26
Small Files trong Spark làm tăng chi phí liệt kê
Read More
Data Skew trong Spark: Phát hiện và tối ưu Join
20
Sep, 26
Data Skew trong Spark xuất hiện khi một số khóa
Read More
1
2
Next
Scroll to Top