awesome-repositories.com
Blog
awesome-repositories.com

Descubre los mejores repositorios open-source con nuestra búsqueda potenciada por IA.

ExplorarBúsquedas curadasAlternativas open-sourceSoftware autohospedableBlogMapa del sitio
ProyectoAcerca deCómo clasificamosPrensaServidor MCP
Aviso legalPrivacidadTérminos
© 2026 Bringes Technology SRL·VAT RO45896025·hello@awesome-repositories.com
·
cube2222 avatar

cube2222/octosql

0
View on GitHub↗
5,258 estrellas·213 forks·Go·MPL-2.0·9 vistas

Octosql

Octosql es un motor de consultas SQL federado, transformador de datos y procesador de SQL en streaming. Permite a los usuarios ejecutar sentencias SQL únicas a través de múltiples fuentes de datos dispares, incluyendo diferentes tipos de bases de datos y formatos de archivo, para combinar y transformar resultados en un conjunto unificado.

El sistema se distingue por tratar archivos CSV, JSONLines y Parquet como tablas virtuales y utilizar una arquitectura basada en plugins para extender la conectividad a motores de almacenamiento externos. Funciona como un procesador de streaming para flujos de datos infinitos, utilizando marcas de agua (watermarks), retracciones y ventanas deslizantes (tumbling windows) para mantener la consistencia en eventos fuera de orden. Además, sirve como generador de datos SQL capaz de producir conjuntos de datos sintéticos y flujos de registros mediante funciones con valores de tabla.

El motor incluye capacidades para realizar joins entre fuentes de datos y análisis multi-fuente, optimizado mediante el push-down de predicados en el lado de la fuente para reducir la transferencia de datos. Gestiona datos complejos a través de un sistema de tipos estáticos con tipos unión y proporciona observabilidad mediante la visualización de planes de ejecución de consultas.

Features

  • Cross-Source Data Integration - Joins and transforms data from multiple different database engines and file formats using a single SQL interface.
  • Federated SQL Query Tools - Provides a federated SQL interface to execute single statements across multiple disparate data sources and merge results.
  • Cross-Source Joins - Executes queries that combine and transform information originating from different database engines or file formats into a single result set.
  • Virtual Table Transformations - Treats CSV, JSONLines, and Parquet files as virtual tables for analysis and transformation via SQL.
  • Streaming Processors - Processes infinite data streams using watermarks and windowing to maintain consistency for out-of-order events.
  • Multi-Source Queries - Runs single SQL statements across diverse databases to merge data from different origins into a unified view.
  • Database Connectivity Plugins - Deno Query allows integrating third-party plugins to query information across diverse database types and external storage systems.
  • Database Connector Plugins - Provides a plugin system to add native connectivity for additional databases like PostgreSQL and MySQL.
  • Infinite Stream Executions - Executes queries on endless data streams using watermarks and retractions to handle out-of-order events.
  • Real-Time Data Streaming - Processes infinite data streams using SQL windows and watermarks to maintain consistency for out-of-order events.
  • SQL Query Execution Engines - Implements a query engine that processes standard SQL commands to join and transform data across different database types and file formats.
  • File Format Querying - Processes JSON, CSV, TSV, and Parquet files by treating them as virtual tables for SQL queries.
  • Multi-Dataset Analysis - Analyzes combined datasets from relational tables and various file formats without migrating data to a central location.
  • Virtual Tables - Treats files like CSV and Parquet as virtual tables to allow SQL querying without data ingestion.
  • Watermark-Based Event Tracking - Uses watermarks to coordinate out-of-order event streams and trigger the completion of time-based windows.
  • Plugin-Based Architectures - Uses a plugin architecture to extend connectivity to various external storage engines and database types.
  • Synthetic Data Generators - Produces synthetic datasets and record streams using table-valued functions for simulation and testing.
  • Stream Joining - Implements in-memory joining of live data streams to merge records based on shared keys.
  • Tumbling Windows - Organizes streaming records into tumbling windows and triggers output updates based on record counts or watermarks.
  • Predicate Pushdown Joins - Minimizes data transfer by matching small input records against large external sources using source-side predicate filtering.
  • Predicate Pushdown - Optimizes performance by pushing filters directly to the data source to reduce record transfer volume.
  • Query Performance Analyzers - Visualizes query execution plans and utilizes predicate push-down to optimize joins against massive remote tables.
  • Retraction-Based State Updates - Ensures consistency in infinite streams by issuing retractions to correct previously emitted out-of-order results.
  • Standard Input Virtual Tables - Pipes information from standard input into the engine, treating live streams as virtual tables.
  • Stream Join Operators - Combines two live data streams in memory using watermarks to buffer records and ensure consistent results.
  • Database Tools - Multi-database SQL query tool.
  • Query Engines - Joins and transforms data across multiple databases and formats.

Historial de estrellas

Gráfico del historial de estrellas de cube2222/octosqlGráfico del historial de estrellas de cube2222/octosql

Búsqueda con IA

Explora más repositorios increíbles

Describe lo que necesitas en lenguaje sencillo: la IA clasifica miles de proyectos open-source curados por relevancia.

Start searching with AI

Alternativas open-source a Octosql

Proyectos open-source similares, clasificados según cuántas características comparten con Octosql.
  • alasql/alasqlA

    AlaSQL/alasql

    7,278Ver en GitHub↗

    AlaSQL is a JavaScript SQL database engine that allows for the filtering, grouping, and joining of in-memory object arrays and JSON data. It functions as an in-memory SQL database and client-side data processor, enabling the execution of SQL statements against JavaScript arrays and external data sources in both browser and server environments. The project serves as a universal data query tool capable of performing relational joins across diverse sources, such as merging Google Spreadsheets, SQLite files, and remote APIs into a single result set. It also acts as an IndexedDB SQL wrapper, allow

    JavaScript
    Ver en GitHub↗7,278
  • risingwavelabs/risingwaveAvatar de risingwavelabs

    risingwavelabs/risingwave

    9,093Ver en GitHub↗

    RisingWave is a cloud-native streaming database and real-time analytics engine that uses standard SQL to process continuous data streams. It functions as a streaming data lakehouse, combining the capabilities of a streaming SQL database with a platform that integrates streaming ingestion with open table formats. The system is distinguished by its use of the PostgreSQL wire protocol, allowing it to integrate with existing SQL tools and drivers. It employs a decoupled compute and storage architecture, persisting streaming state and materialized views in cloud object storage to enable independen

    Rustapache-icebergdata-engineeringdatabase
    Ver en GitHub↗9,093
  • datlechin/tableproAvatar de datlechin

    datlechin/TablePro

    4,471Ver en GitHub↗

    TablePro is a cross-platform database management client designed for browsing, querying, and administering both SQL and NoSQL databases. It functions as a unified workspace that integrates a code-centric SQL editor with schema visualization tools, allowing developers to manage complex data models and execute queries across diverse database engines. The application distinguishes itself through an agentic AI integration layer that connects language models directly to database tools, enabling automated query generation, optimization, and error fixing with configurable approval gates. It features

    Swift
    Ver en GitHub↗4,471
  • pentaho/pentaho-kettleAvatar de pentaho

    pentaho/pentaho-kettle

    8,353Ver en GitHub↗

    Pentaho Kettle is an enterprise ETL data integration platform designed to extract, transform, and load data between disparate sources and target databases. It functions as a metadata-driven orchestrator that utilizes a visual workflow designer to create and manage complex sequences of data tasks and transformation pipelines. The system is distinguished by its distributed data processing engine, which executes workloads across clusters of server nodes to increase throughput. It employs a plugin-based architecture, allowing the platform to be extended via external JAR files to provide connectiv

    Java
    Ver en GitHub↗8,353
Ver las 30 alternativas a Octosql→

Preguntas frecuentes

¿Qué hace cube2222/octosql?

Octosql es un motor de consultas SQL federado, transformador de datos y procesador de SQL en streaming. Permite a los usuarios ejecutar sentencias SQL únicas a través de múltiples fuentes de datos dispares, incluyendo diferentes tipos de bases de datos y formatos de archivo, para combinar y transformar resultados en un conjunto unificado.

¿Cuáles son las características principales de cube2222/octosql?

Las características principales de cube2222/octosql son: Cross-Source Data Integration, Federated SQL Query Tools, Cross-Source Joins, Virtual Table Transformations, Streaming Processors, Multi-Source Queries, Database Connectivity Plugins, Database Connector Plugins.

¿Qué alternativas de código abierto existen para cube2222/octosql?

Las alternativas de código abierto para cube2222/octosql incluyen: alasql/alasql — AlaSQL is a JavaScript SQL database engine that allows for the filtering, grouping, and joining of in-memory object… risingwavelabs/risingwave — RisingWave is a cloud-native streaming database and real-time analytics engine that uses standard SQL to process… datlechin/tablepro — TablePro is a cross-platform database management client designed for browsing, querying, and administering both SQL… pentaho/pentaho-kettle — Pentaho Kettle is an enterprise ETL data integration platform designed to extract, transform, and load data between… dbgate/dbgate — DbGate is a universal database management tool and SQL client that provides a unified interface for querying and… zhisheng17/flink-learning — This project is a collection of educational resources and reference implementations for the Apache Flink stream…