Thank you for sending your enquiry! One of our team members will contact you shortly.
Thank you for sending your booking! One of our team members will contact you shortly.
Duration 21 hours
Course Outline
Greenplum Architecture
- Parallel processing and symmetric multi-processing
- Segment roles and cluster configuration
- Scalability mechanisms and data movement
- Greenplum Data Warehouse architecture
Greenplum Table Structures
- Distributed vs. randomly assigned tables
- Heap vs. append-only tables
- Row-based vs. columnar storage formats
- Partitioned and clustered tables
Data Distribution & Hashing
- Hashing logic and distribution keys
- Managing data skew and its performance impact
- Hash maps and row placement strategies
Indexes & Performance Optimization
- Clustered and non-clustered indexes
- Use cases for B-tree and bitmap indexes
- Index scanning and storage behaviour
Physical Database Design
- Normalization and logical model design
- User access strategies and distribution analysis
- Data demographics and indexing decisions
Denormalization Techniques
- Derived data, summary tables, and pre-joins
- Columnar tables as a form of vertical partitioning
- Data marts and materialized views
Advanced SQL & Query Execution
- Join strategies and redistribution
- OLAP and window functions
- Temporary tables, subqueries, and derived tables
EXPLAIN Plans & Query Tuning
- Reading and interpreting EXPLAIN output
- Cost analysis and plan optimization
- Join movement and segment-local operations
Greenplum Utilities & Best Practices
- ANALYZE and VACUUM commands
- Data loading and movement using Nexus
- Security, permissions, and performance tips
Summary & Next Steps
Requirements
- Proficiency with relational databases and SQL
- Hands-on experience with data warehousing or analytical systems
- Competence in Linux command-line operations
Target Audience
- Data architects and engineers
- Database administrators and technical leads
- BI developers and analytics specialists utilizing Greenplum
Testimonials (1)
the practices