1 dépôt
Increasing total model parameters by storing them in external lookup tables to maintain sparsity.
Distinct from Model Sparsity: Focuses on increasing capacity via external tables, while Model Sparsity generally focuses on zeroing out existing weights.
Explore 1 awesome GitHub repository matching artificial intelligence & ml · External Memory Scaling. Refine with filters or upvote what's useful.
Engram est un système de récupération de connaissances dynamique et un framework d'augmentation de mémoire pour les grands modèles de langage (LLM). Il fonctionne comme une couche de recherche en mémoire scalable et un composant d'architecture creuse conçu pour fusionner les connaissances statiques du modèle avec des états externes dynamiques afin d'améliorer la véracité et réduire les hallucinations. Le système utilise la récupération conditionnelle en mémoire et l'adressage mémoire différentiable pour mapper les jetons d'entrée vers des indices spécifiques au sein d'un magasin de mémoire associative à grande échelle. Cela permet au modèle d'augmenter ses paramètres totaux disponibles en stockant des poids dans des tables de recherche externes et en n'activant que les segments de connaissances pertinents pour une entrée donnée. Le framework couvre l'optimisation de la sparsité des modèles et l'augmentation scalable, utilisant la récupération clé-valeur et la fusion dynamique de paramètres pour améliorer les performances sur des tâches spécialisées sans nécessiter un réentraînement complet du réseau.
Increases total available parameters by storing weights in external lookup tables instead of active layers.