7 dépôts
Layers that execute generic linear transformations across specific tensor dimensions for MLP-style architectures.
Distinct from Linear Regression Implementations: Focuses on mixing dimensions within a tensor rather than standard linear regression models.
Explore 7 awesome GitHub repositories matching artificial intelligence & ml · Linear Mixing Layers. Refine with filters or upvote what's useful.
Einops is a tensor manipulation library that provides a framework-agnostic interface for reshaping, Einstein summation, and multi-dimensional array operations. It serves as an abstraction layer that works across NumPy, PyTorch, TensorFlow, and JAX, allowing for tensor transformations without changing the API. The library distinguishes itself through a declarative notation system that uses readable string patterns to describe tensor rearrangements and reductions. This approach includes an extended Einstein summation interface that supports multi-letter axis names and a named dimension mapping
Executes generic linear transformations across tensor dimensions to implement multi-layer perceptron style architectures.
IP-Adapter is a framework for conditioning pretrained text-to-image diffusion models to use image prompts as visual guides. It serves as a text-to-image model extension that transforms a text-based diffusion model to accept and process image inputs as primary generation sources. The system implements identity preservation to maintain consistent facial features across multiple outputs using a reference photo. It also enables style transfer workflows to produce image variations that preserve the artistic characteristics of a source image. Capabilities cover multi-modal prompting, including the
Uses lightweight trainable linear layers to transform image embeddings for compatibility with attention layers.
ComfyUIIPAdapterplus est une extension basée sur des nœuds pour ComfyUI qui implémente des modèles IPAdapter pour guider la génération d'images en utilisant des images de référence. Il fonctionne comme un outil de prompting d'image et un adaptateur d'image Stable Diffusion, permettant aux fichiers de référence de servir de prompts visuels pour contrôler le style, la composition et l'identité du sujet. Le projet fournit des capacités spécialisées pour maintenir l'identité faciale et des caractéristiques haute fidélité à travers les portraits générés. Il permet le transfert de caractéristiques visuelles et de styles artistiques à partir d'images de référence, ainsi que l'extraction de mises en page spatiales pour guider l'arrangement des objets dans de nouvelles générations. L'extension couvre de larges domaines fonctionnels, incluant le conditionnement d'image IA, la génération de personnages cohérents et le contrôle de la composition d'image.
Provides linear projection layers to align image encoder outputs with the dimensionality of model attention layers.
Flashlight est une bibliothèque de machine learning en C++ et un framework de deep learning conçu pour construire et entraîner des réseaux de neurones. Il fonctionne comme une bibliothèque de manipulation de tenseurs et un moteur de différenciation automatique qui suit les opérations pour calculer les gradients via la rétropropagation pour l'optimisation des modèles. Le projet se distingue par son rôle de framework d'entraînement distribué, utilisant la synchronisation de gradient all-reduce et des environnements distribués pour mettre à l'échelle les charges de travail de machine learning sur plusieurs nœuds et appareils. Il dispose d'une interface mémoire agnostique au backend et d'une gestion basée sur RAII pour découpler les opérations sur tenseurs du matériel physique. Le framework couvre une large surface de capacités, incluant la construction d'architectures de réseaux de neurones avec des couches convolutionnelles, linéaires et récurrentes. Il fournit des utilitaires étendus pour l'algèbre tensorielle, la gestion et le batching de jeux de données, la sérialisation binaire versionnée pour les états de modèle, et des outils de surveillance pour suivre les métriques d'entraînement et l'utilisation de la mémoire.
Multiplies input tensors by learnable weight matrices and adds bias terms for vector space mapping.
This project is a comprehensive instructional resource and course for building neural networks using PyTorch. It covers the fundamental building blocks of deep learning, including tensor manipulation, automatic differentiation, and the construction of modular neural network components. The repository serves as a technical guide for several specialized domains. It provides implementation details for computer vision tasks such as image classification, object detection, and semantic segmentation, as well as natural language processing workflows involving transformers, recurrent networks, and gen
Implements linear transformations using weight matrices and bias terms to map data between vector spaces.
Ce projet est un framework d'apprentissage contrastif auto-supervisé conçu pour entraîner des modèles d'apprentissage profond à apprendre des représentations visuelles à partir d'images sans utiliser d'étiquettes fournies par l'homme. Il fournit un système pour développer des modèles de représentation visuelle pré-entraînés qui peuvent être adaptés pour des tâches de vision par ordinateur en aval. Le framework inclut des outils pour la classification d'images semi-supervisée, qui combine de grands ensembles de données non étiquetés avec de petits ensembles étiquetés pour améliorer la précision. Il dispose également d'un outil d'évaluation par sonde linéaire pour évaluer la qualité des caractéristiques d'image apprises en entraînant un classificateur linéaire simple sur des représentations gelées. La base de code couvre l'entraînement par apprentissage profond distribué et l'accélération matérielle pour gérer de grandes tailles de batch, ainsi que des primitives d'optimisation telles que la planification du taux d'apprentissage par décroissance cosinus et la régularisation par décroissance de poids. Elle fournit également des utilitaires pour la gestion des modèles, y compris la conversion de checkpoints pré-entraînés entre différents formats de framework d'apprentissage profond et des outils pour le déploiement de modèles. L'implémentation est fournie sous forme de collection de Jupyter Notebooks.
Constructs linear layers with optional bias and normalization to evaluate the quality of learned visual representations.
This is a structured deep learning curriculum for programmers, delivered as a collection of Jupyter notebooks. It teaches the fundamentals of training neural networks for computer vision, natural language processing, tabular data analysis, and collaborative filtering using PyTorch and the fastai library. The course is designed to be hands-on, guiding learners from building a training loop from scratch to fine-tuning pretrained models for a variety of practical tasks. The curriculum distinguishes itself by covering the full lifecycle of a deep learning project, from data preparation and augmen
Provides linear block composers that group normalization, dropout, and linear layers for model construction.