awesome-repositories.com
Blog
awesome-repositories.com

Descubre los mejores repositorios open-source con nuestra búsqueda potenciada por IA.

ExplorarBúsquedas curadasAlternativas open-sourceSoftware autohospedableBlogMapa del sitio
ProyectoAcerca deCómo clasificamosPrensaServidor MCP
Aviso legalPrivacidadTérminos
© 2026 Bringes Technology SRL·VAT RO45896025·hello@awesome-repositories.com
·
citusdata avatar

citusdata/pg_shard

0
View on GitHub↗
1,062 estrellas·62 forks·C·LGPL-3.0·5 vistasgithub.com/citusdata/citus↗

Pg Shard

Este proyecto es una extensión de base de datos que permite el escalado horizontal y la partición de datos distribuida en múltiples nodos de PostgreSQL. Funciona como una solución de middleware que distribuye tablas de base de datos grandes a través de un clúster para aumentar la capacidad de almacenamiento total y mejorar el rendimiento de escritura para conjuntos de datos en crecimiento.

El sistema emplea partición basada en hash para distribuir registros de tablas a través de nodos físicos y utiliza un catálogo de metadatos central para rastrear las ubicaciones de los shards. Proporciona enrutamiento de consultas transparente, que dirige comandos SQL estándar desde un nodo coordinador a los nodos trabajadores apropiados sin requerir modificaciones a la lógica de aplicación existente.

El framework incluye herramientas para mantener la redundancia de datos y la integridad del clúster a través de la replicación de shards y procesos automatizados de reparación de consistencia. También admite la ingesta de datos de alto rendimiento, utilizando procesamiento concurrente para importar conjuntos de datos masivos en tablas distribuidas.

Features

  • PostgreSQL Sharding Extensions - Enables horizontal scaling and distributed data partitioning across multiple PostgreSQL nodes for improved write performance.
  • Coordinator-Worker Topologies - Directs incoming SQL commands from a central entry point to the appropriate backend nodes based on metadata.
  • Database Middleware - Routes SQL queries to appropriate worker nodes to provide transparent horizontal scaling for existing database applications.
  • Database Sharding - Partitions data across a cluster of servers to manage massive workloads that exceed the capacity of a single machine.
  • Query Routing - Automatically routes standard database commands from a central node to the appropriate worker nodes without requiring modifications to existing application logic.
  • Horizontal Database Scaling - Distributes large database tables across multiple nodes to increase storage capacity and improve write performance for growing datasets.
  • Horizontal Table Partitionings - Distributes table records across multiple nodes using hash partitioning to achieve horizontal scaling and expand total storage capacity.
  • Hash-Based Data Distribution - Distributes table rows across multiple physical nodes by applying a mathematical function to a specific column value.
  • Bulk Data Ingestion - Supports high-throughput ingestion of massive datasets into distributed tables using concurrent processes to maximize write performance.
  • Cross-Shard Data Replication - Maintains multiple copies of table shards across different worker nodes to ensure data redundancy and high availability during node outages.
  • Database Sharding Solutions - Provides a solution for managing shard replicas and data redundancy to ensure high availability and consistency across a distributed database cluster.
  • Distributed Sharding Architectures - Maintains multiple copies of data segments across different physical servers to ensure high availability and fault tolerance.
  • External File Imports - Enables importing large datasets from external files into distributed tables using parallel processing to achieve high write throughput.
  • Horizontal Scaling - Distributes large database tables across a cluster of nodes to increase total storage capacity and throughput.
  • Parallelized Ingestion - Loads massive volumes of information into a database cluster using concurrent processes to maximize throughput and reduce import times.
  • Asynchronous Replica Synchronizations - Synchronizes data from healthy shard replicas to inconsistent locations to maintain cluster integrity after system errors or hardware failures.
  • High Availability Clusters - Maintains redundant copies of data across multiple nodes to ensure continuous service and prevent data loss during hardware failures.
  • Metadata-Driven Cluster Managements - Tracks the physical location of data shards using a central catalog to coordinate operations across the distributed system.
  • Consistency Repairs - Synchronizes data from healthy shard replicas to inconsistent locations to maintain cluster integrity and ensure data accuracy.

Historial de estrellas

Gráfico del historial de estrellas de citusdata/pg_shardGráfico del historial de estrellas de citusdata/pg_shard

Búsqueda con IA

Explora más repositorios increíbles

Describe lo que necesitas en lenguaje sencillo: la IA clasifica miles de proyectos open-source curados por relevancia.

Start searching with AI

Colecciones destacadas con Pg Shard

Colecciones seleccionadas manualmente donde aparece Pg Shard.
  • Bases de datos SQL distribuidas

Preguntas frecuentes

¿Qué hace citusdata/pg_shard?

Este proyecto es una extensión de base de datos que permite el escalado horizontal y la partición de datos distribuida en múltiples nodos de PostgreSQL. Funciona como una solución de middleware que distribuye tablas de base de datos grandes a través de un clúster para aumentar la capacidad de almacenamiento total y mejorar el rendimiento de escritura para conjuntos de datos en crecimiento.

¿Cuáles son las características principales de citusdata/pg_shard?

Las características principales de citusdata/pg_shard son: PostgreSQL Sharding Extensions, Coordinator-Worker Topologies, Database Middleware, Database Sharding, Query Routing, Horizontal Database Scaling, Horizontal Table Partitionings, Hash-Based Data Distribution.

¿Qué alternativas de código abierto existen para citusdata/pg_shard?

Las alternativas de código abierto para citusdata/pg_shard incluyen: pgdogdev/pgdog — pgdog is a PostgreSQL sharding proxy, distributed SQL router, and connection pooler. It is designed to enable… citusdata/citus — Citus is a PostgreSQL extension that transforms a standard database into a distributed system. It functions as a… alibaba/alisql — AliSQL is a fork of MySQL by Alibaba that extends the relational database management system with enhancements for high… apache/pinot — Pinot is a distributed, columnar analytical database designed for high-concurrency, low-latency query processing. It… oceanbase/oceanbase — OceanBase is a distributed SQL database designed for high availability and strong consistency across multiple nodes… ydb-platform/ydb — YDB is a distributed SQL database and analytical engine designed for horizontal scalability and strong consistency. It…

Alternativas open-source a Pg Shard

Proyectos open-source similares, clasificados según cuántas características comparten con Pg Shard.
  • pgdogdev/pgdogAvatar de pgdogdev

    pgdogdev/pgdog

    3,361Ver en GitHub↗

    pgdog is a PostgreSQL sharding proxy, distributed SQL router, and connection pooler. It is designed to enable horizontal data distribution by splitting tables and indices across multiple independent servers to scale storage and processing capacity. The project distinguishes itself through online resharding capabilities, using logical replication to move data between shards without application downtime. It supports multiple routing strategies, including hash, list, and range-based query routing, and manages distributed atomic transactions using a two-phase commit process to ensure consistency

    Rustload-balancerpoolerpostgresql
    Ver en GitHub↗3,361
  • citusdata/citusAvatar de citusdata

    citusdata/citus

    12,562Ver en GitHub↗

    Citus is a PostgreSQL extension that transforms a standard database into a distributed system. It functions as a sharding framework and distributed SQL engine, enabling horizontal scaling by partitioning tables across a cluster of nodes. By utilizing a coordinator-worker topology, the system manages metadata and routes queries to the appropriate nodes, allowing for parallel execution of complex operations across distributed data shards. The platform distinguishes itself through its specialized support for multi-tenant architectures and real-time analytical processing. It enables tenant-based

    Ccituscitus-extensiondatabase
    Ver en GitHub↗12,562
  • alibaba/alisqlAvatar de alibaba

    alibaba/AliSQL

    5,706Ver en GitHub↗

    AliSQL is a fork of MySQL by Alibaba that extends the relational database management system with enhancements for high performance, scalability, and enterprise-grade availability. It retains the core MySQL identity as a SQL-based database for storing, organizing, and retrieving structured data, while adding optimizations for large-scale transactional and analytical workloads. The project differentiates itself through a set of Alibaba-specific improvements, including a columnar engine for accelerating analytical queries directly on MySQL tables, and a distributed, shared-nothing NDB Cluster en

    C++alisqldatabaseduckdb
    Ver en GitHub↗5,706
  • apache/pinotAvatar de apache

    apache/pinot

    6,098Ver en GitHub↗

    Pinot is a distributed, columnar analytical database designed for high-concurrency, low-latency query processing. It functions as a real-time OLAP datastore, enabling interactive, user-facing analytics by ingesting and querying massive datasets from both streaming and batch sources. The system architecture relies on a centralized controller for cluster coordination and a distributed segment-based storage model to ensure horizontal scalability. The platform distinguishes itself through a hybrid ingestion pipeline that unifies real-time event streams and historical batch data into a single quer

    Java
    Ver en GitHub↗6,098
Ver las 30 alternativas a Pg Shard→