awesome-repositories.com
Blog
MCP
awesome-repositories.com

Descoperă cele mai bune repository-uri open source cu căutare AI.

ExploreazăCăutări recomandateAlternative open-sourceSoftware self-hostedBlogHartă site
ProiectServer MCPDespreCum realizăm clasamentulPresă
LegalConfidențialitateTermeni
© 2026 Bringes Technology SRL·VAT RO45896025·hello@awesome-repositories.com
·

7 repository-uri

Awesome GitHub RepositoriesParallel Loading

Integration of parallelism strategies during weight loading.

Explore 7 awesome GitHub repositories matching artificial intelligence & ml · Parallel Loading. Refine with filters or upvote what's useful.

Awesome Parallel Loading GitHub Repositories

Găsește cele mai bune repo-uri cu AI.Vom căuta cele mai potrivite repository-uri folosind AI.
  • huggingface/transformersAvatar huggingface

    huggingface/transformers

    161,630Vezi pe GitHub↗

    Transformers is a comprehensive library for machine learning that provides a unified interface for training, fine-tuning, and deploying transformer-based models. It supports a wide range of tasks, including text classification, language modeling, question answering, and sequence-to-sequence translation, while offering specialized architectures for both text and vision processing. The framework includes tools for managing the entire model lifecycle, from data preprocessing and tokenization to distributed training and inference. The library features extensive support for model optimization and

    Shards tensors during materialization to allow each rank to load only the necessary portion of weight data during parallel training.

    Pythonaudiodeep-learningdeepseek
    Vezi pe GitHub↗161,630
  • sgl-project/sglangAvatar sgl-project

    sgl-project/sglang

    29,079Vezi pe GitHub↗

    Sglang is a high-performance inference engine and serving system designed for large language and multimodal models. It provides a programmable interface for orchestrating complex generation workflows, enabling developers to coordinate multi-turn dialogues, tool invocations, and reasoning chains through a domain-specific language. The platform is built to support production-scale deployments, offering an OpenAI-compatible API that allows for integration with existing application ecosystems. The system distinguishes itself through a disaggregated architecture that separates compute-intensive pr

    Distributes weight loading across multiple processes and nodes to reduce initialization time for large models.

    Pythonattentionblackwellcuda
    Vezi pe GitHub↗29,079
  • pytorch/tutorialsAvatar pytorch

    pytorch/tutorials

    9,202Vezi pe GitHub↗

    The PyTorch Tutorials repository is a collection of educational resources that provides step-by-step guidance on building, training, and deploying neural networks using the PyTorch framework. It covers the complete machine learning workflow, from data loading and model definition through optimization loops and model persistence, with dedicated guides for distributed training, model fine-tuning, and deployment. The tutorials offer practical demonstrations of adapting pre-trained models to new tasks through transfer learning, scaling training across multiple GPUs or machines using PyTorch's dis

    Optimizes DataLoader settings like worker count and memory pinning to maximize training throughput.

    Python
    Vezi pe GitHub↗9,202
  • tingsongyu/pytorch_tutorialAvatar TingsongYu

    TingsongYu/PyTorch_Tutorial

    8,018Vezi pe GitHub↗

    This project is a comprehensive collection of educational examples and reference implementations for building vision and language models using PyTorch. It serves as a deep learning tutorial covering the end-to-end process of developing neural networks, from initial architecture definition to final production deployment. The repository provides detailed guides on implementing a wide range of domain-specific models, including convolutional neural networks for object detection and segmentation, as well as transformer and recurrent architectures for natural language processing. It emphasizes gene

    Implements multi-process data loading to prevent CPU bottlenecks during model training.

    Python
    Vezi pe GitHub↗8,018
  • kingoflolz/mesh-transformer-jaxAvatar kingoflolz

    kingoflolz/mesh-transformer-jax

    6,376Vezi pe GitHub↗

    Acest proiect este un framework de transformatoare bazat pe JAX și un antrenor de modele de limbaj mari, conceput pentru construirea și antrenarea modelelor distribuite pe acceleratoare hardware TPU. Oferă un sistem pentru pre-antrenare și fine-tuning-ul modelelor autoregresive prin împărțirea ponderilor și a calculelor pe o rețea de dispozitive pentru a reduce overhead-ul de memorie și a crește viteza de procesare. Framework-ul include un orchestrator de calcul TPU pentru provizionarea resurselor și automatizarea instalării dependențelor pe noduri distribuite la distanță. De asemenea, dispune de un convertor de ponderi de model capabil să transforme și să redistribuie checkpoint-urile între diferite configurații hardware și precizii numerice. Proiectul acoperă capabilități mai largi, inclusiv gestionarea checkpoint-urilor partajate pentru stocarea în cloud, încărcarea datelor bazată pe flux cu restaurarea stării și generarea de text bazată pe nucleu pentru inferența modelului. De asemenea, suportă accelerarea hardware compilată XLA pentru clustere TPU și GPU și oferă instrumente pentru benchmarking-ul performanței față de sarcini lingvistice standardizate.

    Tracks processed files and batch indices to resume training data loading from a specific point after interruption.

    Python
    Vezi pe GitHub↗6,376
  • ppwwyyxx/tensorpackAvatar ppwwyyxx

    ppwwyyxx/tensorpack

    6,287Vezi pe GitHub↗

    Tensorpack este un framework de antrenare TensorFlow de înaltă performanță și un toolkit de deep learning distribuit. Oferă o suită de instrumente pentru construirea și antrenarea rețelelor neuronale cu accent pe viteza de execuție și flexibilitatea arhitecturală. Proiectul servește drept suită de optimizare a rețelelor neuronale, implementând tipare de execuție de înaltă eficiență pentru a reduce overhead-ul de antrenare. Funcționează ca un pipeline de încărcare a datelor în paralel, utilizând paralelizarea automată pentru a maximiza debitul la procesarea seturilor de date mari. Toolkit-ul acoperă antrenarea distribuită pe mai multe GPU-uri și clustere de calcul folosind strategii de paralelizare a datelor. Capabilitățile sale includ procesarea seturilor de date la scară largă și optimizarea performanței pentru a crește debitul de antrenare.

    Utilizes multi-process data loading and parallelization strategies to maximize throughput for large datasets.

    Python
    Vezi pe GitHub↗6,287
  • tingsongyu/pytorch-tutorial-2ndAvatar TingsongYu

    TingsongYu/PyTorch-Tutorial-2nd

    4,555Vezi pe GitHub↗

    Acest proiect este o resursă educațională cuprinzătoare și un curs pentru construirea de rețele neuronale folosind PyTorch. Acoperă elementele fundamentale ale deep learning-ului, inclusiv manipularea tensorilor, diferențierea automată și construcția componentelor modulare de rețele neuronale. Repository-ul servește drept ghid tehnic pentru mai multe domenii specializate. Oferă detalii de implementare pentru sarcini de computer vision, cum ar fi clasificarea imaginilor, detecția obiectelor și segmentarea semantică, precum și fluxuri de lucru de procesare a limbajului natural (NLP) care implică transformatoare, rețele recurente și modele generative. În plus, include o referință pentru AI generativ, concentrându-se în mod specific pe sinteza de imagini prin modele de difuzie și rețele adversariale. Materialul se extinde către optimizarea modelelor și pipeline-uri de deployment. Acoperă tehnici pentru reducerea dimensiunii modelelor și creșterea vitezei de inferență prin cuantizare și exportul modelelor în formate precum ONNX și TensorRT. Alte domenii de capabilitate includ ingineria datelor pentru încărcarea paralelă, evaluarea modelelor folosind metrici personalizate și deployment-ul modelelor de limbaj mari (LLM) open-source. Proiectul este livrat în principal sub formă de serie de Jupyter Notebooks.

    Provides parallel data loading strategies using multiple CPU subprocesses and pinned memory to optimize GPU throughput.

    Jupyter Notebookcomputer-visiondeepsortdiffusion-models
    Vezi pe GitHub↗4,555
  1. Home
  2. Artificial Intelligence & ML
  3. Machine Learning
  4. Infrastructure
  5. Training & Tuning
  6. Data and Checkpointing
  7. Model Loading
  8. Parallel Loading

Explorează sub-etichetele

  • Multi-Process Data Loading1 sub-tagParallel data loading strategies using multiple processes and pinned memory to optimize GPU throughput. **Distinct from Parallel Loading:** Focuses on the CPU-to-GPU data transfer pipeline and multi-processing, whereas the candidate refers to weight loading parallelism.