Get in Touch
 Duration 7 hours

Course Outline

1. Introduction to Distributed PostgreSQL

  • Challenges associated with scaling single-node PostgreSQL
  • Overview of the Citus extension, including its purpose, architecture, and key components
  • Core concepts: coordinator node, worker nodes, metadata, and distribution keys

2. Cluster Architecture and Setup

  • Node types: distinguishing between coordinators and workers
  • Table types: distributed, replicated, and local tables
  • Installing and configuring Citus within existing PostgreSQL environments
  • Cluster discovery and node management

3. Data Distribution and Sharding Strategies

  • Sharding methods: hash versus append
  • Selecting the appropriate distribution column for optimal performance
  • Managing distributed and replicated tables
  • Re-balancing shards and strategies for scaling out

4. Distributed Query Execution and Optimisation

  • How Citus routes and parallelises queries
  • Interpreting distributed query plans
  • Query pushdown and execution optimisation

5. Consistency, Transactions and Fault Tolerance

  • Two-Phase Commit (2PC) and atomic operations
  • Handling failures within distributed transactions

6. Operational Management and Use Cases

  • Monitoring tools and views specific to Citus
  • Maintenance and upgrade procedures in distributed environments

Requirements

  • Completion of the Advanced Administration (High Availability & Replication) course or equivalent practical experience
  • Proficiency in PostgreSQL configuration and performance tuning
  • Familiarity with Linux systems and fundamental networking concepts

Audience

This course is tailored for seasoned Database Administrators, DevOps Engineers, and System Architects who currently manage production PostgreSQL environments and require strategies for horizontal scaling.

Number of participants


Price per participant

Testimonials (2)

Upcoming Courses

Related Categories