awesome-repositories.com
Blog
awesome-repositories.com

Descubre los mejores repositorios open-source con nuestra búsqueda potenciada por IA.

ExplorarBúsquedas curadasAlternativas open-sourceSoftware autohospedableBlogMapa del sitio
ProyectoAcerca deCómo clasificamosPrensaServidor MCP
Aviso legalPrivacidadTérminos
© 2026 Bringes Technology SRL·VAT RO45896025·hello@awesome-repositories.com
·
nucleuscloud avatar

nucleuscloud/neosyncArchived

0
View on GitHub↗
4,149 estrellas·231 forks·Go·2 vistaswww.neosync.dev↗

Neosync

NeoSync es una herramienta de sincronización de bases de datos y orquestador de pipelines de datos diseñado para mover y transformar conjuntos de datos entre diferentes entornos. Funciona como una plataforma de seguridad de datos PII y un generador de datos sintéticos, permitiendo la sincronización de datos de producción mientras se garantiza el cumplimiento de la privacidad.

El sistema utiliza un coordinador basado en eventos para gestionar los movimientos de datos asíncronos, proporcionando reintentos automatizados y manejo de fallos. Se diferencia al combinar la anonimización y detección de PII basada en reglas con la generación de datos sintéticos basada en esquemas para crear conjuntos de datos artificiales que imitan las propiedades de producción sin exponer información privada.

El proyecto cubre áreas de capacidad amplias, incluyendo el subconjunto de bases de datos para reducir el volumen de datos para pruebas, transformaciones de campos basadas en plantillas para remodelar la información y la orquestación de pipelines de datos para mantener la integridad relacional durante la sincronización.

Features

  • Database Environment Synchronization - Synchronizes and transforms data slices between production and development environments with built-in failure management.
  • Synthetic Data Generators - Creates artificial datasets that mimic production properties for unit testing, seeding, and demonstrations.
  • Relational Database Subsetting - Extracts specific data slices from production databases while maintaining referential integrity for local development.
  • Data Pipeline Orchestration - Coordinates asynchronous data movements and processing tasks with automated failure recovery.
  • Database Synchronization Tools - Syncs production data across environments while applying subsetting, anonymization, and transformation rules.
  • Production Data Subsetting - Extracts representative record slices from production databases to reduce data volume for local testing.
  • Data Anonymization - Removes personally identifiable information from production datasets to enable safe local development and testing.
  • PII Detection and Screening - Identifies and masks personally identifiable information using pattern matching and replacement logic to ensure privacy compliance.
  • PII Security Platforms - Offers a comprehensive platform to monitor, detect, and anonymize PII within production datasets for privacy compliance.
  • Pipeline Orchestration - Implements an event-sourced coordinator to ensure reliable data pipeline execution with automated retry and failure handling.
  • Synthetic Dataset Generation - Produces artificial datasets by analyzing database schemas to maintain relational integrity without using real production data.
  • Field Transformations - Modifies specific data columns during synchronization using predefined scripts or models to reshape information.
  • Background Data Synchronization - Provides background workers to move datasets between environments without blocking the main application execution.

Historial de estrellas

Gráfico del historial de estrellas de nucleuscloud/neosyncGráfico del historial de estrellas de nucleuscloud/neosync

Búsqueda con IA

Explora más repositorios increíbles

Describe lo que necesitas en lenguaje sencillo: la IA clasifica miles de proyectos open-source curados por relevancia.

Start searching with AI

Alternativas open-source a Neosync

Proyectos open-source similares, clasificados según cuántas características comparten con Neosync.
  • lk-geimfari/mimesisAvatar de lk-geimfari

    lk-geimfari/mimesis

    4,818Ver en GitHub↗

    Mimesis is a Python synthetic data generator used to create realistic fake datasets and mock data for software testing and development. It functions as a schema-based dataset generator capable of producing structured records and relational datasets, while also serving as a production data anonymizer to replace sensitive information with synthetic values. The library distinguishes itself through comprehensive multilingual support, allowing for the generation of locale-specific information to simulate regional user profiles. It ensures reproducibility through deterministic data generation using

    Pythondatadataframedatascience
    Ver en GitHub↗4,818
  • qovery/replibyteAvatar de Qovery

    Qovery/Replibyte

    4,381Ver en GitHub↗

    Replibyte is a tool that automates the lifecycle of database snapshots for non-production environments, handling the export, anonymization, subsetting, and restoration of data. It is designed to support privacy-compliant development workflows by replacing sensitive production data with synthetic values and extracting consistent subsets of rows while preserving referential integrity. The tool operates through a configurable pipeline defined in a YAML file, orchestrating stages such as dump, anonymize, subset, and restore. Each operation runs as an isolated, ephemeral container job, and snapsho

    Rustawsbackupcloud
    Ver en GitHub↗4,381
  • microsoft/presidioAvatar de microsoft

    microsoft/presidio

    6,995Ver en GitHub↗

    Presidio is a PII detection and anonymization framework designed to identify and mask personally identifiable information in text. It functions as a PII recognition pipeline and a data masking engine, using a combination of machine learning, regular expressions, and rule-based logic to locate sensitive entities. The system acts as an NER model orchestrator, allowing for the integration of external named entity recognition models and PII detectors to support multi-language privacy scrubbing. It employs a plugin-based recognizer architecture that can be extended with custom recognizers, deny-li

    Pythonanonymizationdata-anonymizationdata-masking
    Ver en GitHub↗6,995
  • apache/incubator-airflowAvatar de apache

    apache/incubator-airflow

    45,840Ver en GitHub↗

    This project is a Python workflow orchestration platform and programmatic data pipeline engine used to author, schedule, and monitor complex data pipelines. It functions as a directed acyclic graph manager and scheduler, allowing users to define data movement and transformation tasks as code to ensure precise execution order and maintainability. The platform distinguishes itself by treating workflows as code, enabling pipelines to be versioned and tested through a standard programming language. It utilizes a system of extensible operators to encapsulate integration logic and employs a templat

    Python
    Ver en GitHub↗45,840
Ver las 30 alternativas a Neosync→

Preguntas frecuentes

¿Qué hace nucleuscloud/neosync?

NeoSync es una herramienta de sincronización de bases de datos y orquestador de pipelines de datos diseñado para mover y transformar conjuntos de datos entre diferentes entornos. Funciona como una plataforma de seguridad de datos PII y un generador de datos sintéticos, permitiendo la sincronización de datos de producción mientras se garantiza el cumplimiento de la privacidad.

¿Cuáles son las características principales de nucleuscloud/neosync?

Las características principales de nucleuscloud/neosync son: Database Environment Synchronization, Synthetic Data Generators, Relational Database Subsetting, Data Pipeline Orchestration, Database Synchronization Tools, Production Data Subsetting, Data Anonymization, PII Detection and Screening.

¿Qué alternativas de código abierto existen para nucleuscloud/neosync?

Las alternativas de código abierto para nucleuscloud/neosync incluyen: lk-geimfari/mimesis — Mimesis is a Python synthetic data generator used to create realistic fake datasets and mock data for software testing… qovery/replibyte — Replibyte is a tool that automates the lifecycle of database snapshots for non-production environments, handling the… microsoft/presidio — Presidio is a PII detection and anonymization framework designed to identify and mask personally identifiable… dbt-labs/dbt-core — dbt-core is a command-line framework for transforming data within a warehouse using modular SQL and version control.… dagster-io/dagster — Dagster is a data orchestration platform designed to manage the entire lifecycle of data assets through declarative… apache/incubator-airflow — This project is a Python workflow orchestration platform and programmatic data pipeline engine used to author,…