1 مستودع
Educational content on using quantization and mixture-of-experts to reduce computational footprints.
Distinct from Mixture of Experts Optimizations: Focuses on the educational study of efficiency techniques rather than specific adapter optimizations
Explore 1 awesome GitHub repository matching artificial intelligence & ml · Model Efficiency Techniques. Refine with filters or upvote what's useful.
هذا المشروع هو دليل دراسة دورة تقنية شامل ومرجع لتعلم بنيات وطرق تدريب المحولات (Transformers) ونماذج اللغة الكبيرة. يعمل كنظرة عامة تقنية لفهم كيفية معالجة الشبكات العصبية للبيانات وكيفية مواءمة سلوك النموذج مع أهداف أداء محددة. يوفر المستودع أدلة متخصصة حول العديد من المجالات الرئيسية لتطوير النماذج. يتضمن ذلك مراجع مفصلة لبنيات المحولات، وأطر عمل التنفيذ للتوليد المعزز بالاسترجاع وسير عمل الوكلاء، وأدلة تقنية لتحسين النماذج وضبطها بدقة. يغطي المحتوى مجموعة واسعة من القدرات، بما في ذلك الضبط الدقيق الخاضع للإشراف، والتكيف منخفض الرتبة، والمواءمة القائمة على التفضيلات. كما يتناول كفاءة النموذج من خلال التكميم، والتقطير، وبنيات خليط الخبراء، إلى جانب دراسة آليات الانتباه الذاتي والانتباه السريع.
Teaches the use of mixture-of-experts and quantization to lower computational requirements for deployment.