2 repositorios
Joins that match observations based on flexible inequalities or range relationships rather than exact equality.
Distinct from Data Joins: Specifically handles range or inequality matches, whereas general data joins typically imply exact key matches.
Explore 2 awesome GitHub repositories matching data & databases · Non-Equi Joins. Refine with filters or upvote what's useful.
r4ds es un currículo de ciencia de datos y recurso educativo diseñado para dominar el lenguaje de programación R. Proporciona una ruta de aprendizaje estructurada para el proceso de extremo a extremo de importar, limpiar, transformar y visualizar datos. El proyecto enfatiza una guía de ciencia de datos reproducible y un currículo integral para la manipulación de datos (data wrangling). Incluye tutoriales especializados sobre la gramática de gráficos para la visualización de datos en capas y publicaciones técnicas creadas con Quarto que combinan código ejecutable con prosa narrativa. El material cubre una amplia gama de capacidades analíticas, incluyendo la ingesta de datos de diversas fuentes, unión de datos relacionales y la gestión de variables categóricas. También aborda la limpieza de datos, modelado matemático y la generación de informes y presentaciones profesionales en múltiples formatos. El currículo se centra en la aplicación práctica de la programación funcional y los principios de datos ordenados (tidy data) para crear análisis transparentes y repetibles.
Supports matching observations between datasets using flexible inequalities or range relationships.
This project is a high-performance tabular data processing framework for R, designed to handle massive datasets with memory efficiency and speed. It provides an enhanced data structure that utilizes reference semantics and in-place modification to perform complex transformations without the overhead of unnecessary object copying. The library distinguishes itself through its low-level architectural optimizations, including multi-threaded parallel processing, radix-based sorting, and memory-mapped file parsing. By offloading critical data manipulation and aggregation routines to compiled C code
Matches rows using comparison operators like inequalities to compare numeric ranges or dates.