Get in Touch
 Duration 7 hours

Course Outline

1. Introduction to Distributed PostgreSQL

  • Challenges in scaling single-node PostgreSQL
  • Overview of the Citus extension: objectives, architecture, and key components
  • Core concepts: coordinator node, worker nodes, metadata, and distribution keys

2. Cluster Architecture and Configuration

  • Node roles: coordinator versus workers
  • Table categories: distributed, replicated, and local tables
  • Installing and configuring Citus within existing PostgreSQL environments
  • Cluster discovery and node management

3. Data Distribution and Sharding Strategies

  • Sharding techniques: hash versus append
  • Choosing a distribution column for optimal performance
  • Managing distributed and replicated tables
  • Re-balancing shards and horizontal scaling

4. Distributed Query Execution and Optimisation

  • How Citus routes and parallelises queries
  • Interpreting distributed query plans
  • Query pushdown and execution optimisation

5. Consistency, Transactions, and Fault Tolerance

  • Two-Phase Commit (2PC) and atomic operations
  • Managing failures within distributed transactions

6. Operational Management and Use Cases

  • Monitoring tools and views specific to Citus
  • Maintenance and upgrade processes in distributed environments

Requirements

  • Completion of Advanced Administration (High Availability & Replication) or comparable expertise
  • Strong command of PostgreSQL configuration and performance tuning
  • Working knowledge of Linux and fundamental networking concepts

Audience

Seasoned Database Administrators, DevOps Engineers, and System Architects who currently manage production PostgreSQL environments and require the capability to scale them horizontally.

Number of participants


Price per participant

Testimonials (2)

Provisional Upcoming Courses (Require 5+ participants)

Related Categories