# apache/kylin

**Attribution required: if you use, quote, or summarise this content, you must credit and link back to [awesome-repositories.com](https://awesome-repositories.com/repository/apache-kylin).**

3,765 stars · 1,511 forks · Java · Apache-2.0

## Links

- GitHub: https://github.com/apache/kylin
- awesome-repositories: https://awesome-repositories.com/repository/apache-kylin.md

## Topics

`kylin`

## Description

Kylin is a distributed OLAP engine designed for executing fast SQL queries on massive datasets. It utilizes multi-dimensional data cubes to pre-calculate data aggregates, enabling sub-second response times for large-scale analytical queries and big data analytics.

The system focuses on large-scale data warehousing and multi-dimensional data modeling. It allows for the organization and querying of vast amounts of structured data to support business intelligence and reporting workflows through distributed SQL querying.

## Tags

### Data & Databases

- [Cubes](https://awesome-repositories.com/f/data-databases/dataset-aggregations/pre-aggregation-refreshers/pre-aggregated-data-queries/cubes.md) — Utilizes a pre-computed cube architecture to convert complex analytical queries into simple lookups for sub-second responses.
- [Data Warehousing](https://awesome-repositories.com/f/data-databases/data-warehousing.md) — Provides a platform for large-scale data storage and high-performance analytical query execution to support business intelligence.
- [Hadoop](https://awesome-repositories.com/f/data-databases/data-warehousing/hadoop.md) — Persists massive datasets and pre-computed cubes on the Hadoop distributed file system for scalability.
- [Distributed SQL Querying](https://awesome-repositories.com/f/data-databases/distributed-sql-querying.md) — Provides a distributed engine to execute relational SQL queries and transformations on structured data across a cluster. ([source](https://cdn.jsdelivr.net/gh/apache/kylin@kylin5/README.md))
- [Data Cubes](https://awesome-repositories.com/f/data-databases/grouped-aggregations/multi-dimensional-aggregations/data-cubes.md) — Pre-calculates data aggregates into multi-dimensional cubes to provide sub-second response times for large-scale queries.
- [Multi-Dimensional Analysis](https://awesome-repositories.com/f/data-databases/multi-dimensional-analysis.md) — Executes complex analytical queries on large datasets using a distributed engine for high-speed responses. ([source](https://cdn.jsdelivr.net/gh/apache/kylin@kylin5/README.md))
- [OLAP Database Engines](https://awesome-repositories.com/f/data-databases/olap-database-engines.md) — Operates as a distributed database optimized for high-performance multi-dimensional analytics and read-heavy workloads.
- [Distributed Schema Management](https://awesome-repositories.com/f/data-databases/database-schema-managers/distributed-schema-management.md) — Tracks data definitions and cube specifications in a relational database to coordinate distributed query execution.
- [Dimensional Data Modeling](https://awesome-repositories.com/f/data-databases/dimensional-data-modeling.md) — Structures data into facts and dimensions via cubes to optimize for analytical querying and reporting.
- [Multi-Dimensional Data Indexing](https://awesome-repositories.com/f/data-databases/multi-dimensional-data-indexing.md) — Maps high-cardinality dimensions to physical storage locations to minimize data scanning during retrieval.
- [Cube Translation](https://awesome-repositories.com/f/data-databases/sql-statement-parsing/mapping-to-sql-converters/semantic-to-sql-translation/cube-translation.md) — Converts standard SQL queries into a specialized internal format that targets pre-computed data slices.

### Part of an Awesome List

- [Big Data and Analytics](https://awesome-repositories.com/f/awesome-lists/data/big-data-and-analytics.md) — Provides a comprehensive platform for running complex SQL commands and analyzing massive datasets across distributed systems.
