awesome-repositories.com
Blog
MCP
awesome-repositories.com

Descubre los mejores repositorios open-source con nuestra búsqueda potenciada por IA.

ExplorarBúsquedas curadasAlternativas open-sourceSoftware autohospedableBlogMapa del sitio
ProyectoServidor MCPAcerca deCómo clasificamosPrensa
Aviso legalPrivacidadTérminos
© 2026 Bringes Technology SRL·VAT RO45896025·hello@awesome-repositories.com
·

1 repositorio

Awesome GitHub RepositoriesDataset Decoding

Converting encoded columnar data batches into structured object formats based on a specific schema.

Distinct from Apache Arrow-Based Formats: Focuses on the decoding process from Arrow memory layout to model-ready formats, not just the storage standard.

Explore 1 awesome GitHub repository matching data & databases · Dataset Decoding. Refine with filters or upvote what's useful.

Awesome Dataset Decoding GitHub Repositories

Encuentra los mejores repositorios con IA.Buscaremos los repositorios que mejor coincidan usando IA.
  • awslabs/gluontsAvatar de awslabs

    awslabs/gluonts

    5,199Ver en GitHub↗

    GluonTS es una librería de series temporales probabilísticas y framework de pronóstico de aprendizaje profundo. Proporciona un kit de herramientas para construir, entrenar y evaluar arquitecturas de redes neuronales que predicen valores futuros como distribuciones de probabilidad para cuantificar la incertidumbre. El proyecto se distingue por soportar el pronóstico zero-shot e integrar diversos enfoques de modelado, incluyendo redes neuronales probabilísticas profundas y envoltorios para librerías estadísticas externas como Prophet y R forecast. Implementa primitivas arquitectónicas especializadas como convoluciones causales y redes residuales invertibles para prevenir la fuga de información y mapear representaciones latentes en distribuciones de probabilidad válidas. El framework cubre una superficie de ingeniería de datos integral, incluyendo escalado de series temporales, transformaciones biyectivas y modelado jerárquico. Utiliza Apache Arrow y Parquet para el streaming de conjuntos de datos de alto rendimiento y la gestión de acceso aleatorio. Para la evaluación de modelos, incluye una suite de evaluación para medir la precisión del pronóstico y la cobertura probabilística utilizando métricas como la pérdida de cuantiles y puntuaciones de probabilidad de rango continuo. La librería soporta el despliegue de modelos a través de la integración con Amazon SageMaker.

    Converts encoded Apache Arrow data batches into time series formats using predefined schemas.

    Pythonartificial-intelligenceawsdata-science
    Ver en GitHub↗5,199
  1. Home
  2. Data & Databases
  3. In-Memory Data Stores
  4. Columnar Formats
  5. Apache Arrow-Based Formats
  6. Dataset Decoding