awesome-repositories.comالتصنيفاتالمدونة
MCP
awesome-repositories.com

اكتشف أفضل مستودعات المصادر المفتوحة باستخدام بحث مدعوم بالذكاء الاصطناعي.

استكشفعمليات بحث منسقةبدائل مفتوحة المصدربرمجيات ذاتية الاستضافةالمدونةخريطة الموقع
المشروعخادم MCPحولكيفية ترتيب النتائجالصحافة
قانونيالخصوصيةالشروط
© 2026 Bringes Technology SRL·VAT RO45896025·hello@awesome-repositories.com
·

2 مستودعات

Awesome GitHub RepositoriesTraining Data Compression

Compression techniques specifically designed to reduce the footprint of training datasets.

Distinct from Video Processing: Distinct from general video codecs by focusing on reducing training costs while preserving quality.

Explore 2 awesome GitHub repositories matching part of an awesome list · Training Data Compression. Refine with filters or upvote what's useful.

Awesome Training Data Compression GitHub Repositories

اعثر على أفضل المستودعات باستخدام الذكاء الاصطناعي.سنبحث عن أفضل المستودعات المطابقة باستخدام الذكاء الاصطناعي.
  • pku-yuangroup/open-sora-planالصورة الرمزية لـ PKU-YuanGroup

    PKU-YuanGroup/Open-Sora-Plan

    12,163عرض على GitHub↗

    Open-Sora-Plan is a text-to-video framework and distributed video training system. It utilizes a diffusion transformer architecture and large language model components to transform written descriptions or image prompts into high-quality video sequences. The system features a distributed infrastructure designed for large-scale video training and inference. It employs sequence parallelism to split high-resolution or long-duration video samples across multiple GPUs and uses a sparse attention mechanism to increase processing speed. The project includes capabilities for both text-to-video and im

    Reduces the size of video frames to lower training costs while preserving high image quality.

    Python
    عرض على GitHub↗12,163
  • facebookresearch/starspaceالصورة الرمزية لـ facebookresearch

    facebookresearch/Starspace

    3,954عرض على GitHub↗

    Starspace هو إطار عمل لتضمين المتجهات (vector embedding) مصمم لتدريب تمثيلات عالية الأبعاد للنصوص والصور. يعمل كنظام تعلم آلي للترتيب العصبي، وتصنيف النصوص، وتضمين الرسوم البيانية للمعرفة، حيث يقوم بتعيين أنواع كائنات مختلفة في مساحة عددية مشتركة لتسهيل مهام الاسترجاع والتنبؤ. يتضمن النظام أدوات متخصصة لإكمال الرسوم البيانية للمعرفة والتنبؤ بالروابط من خلال تمثيل الكيانات وعلاقاتها داخل مساحة متجهية متعددة العلاقات. كما يوفر قدرات لتوصية المحتوى الدلالي وتصنيف النصوص واسع النطاق عن طريق تعيين المدخلات إلى تسميات مستهدفة أو عناصر مرشحة. يغطي إطار العمل مجالات قدرة واسعة بما في ذلك ترتيب الكيانات القائم على التشابه، واستخراج تضمين المتجهات من المستندات أو n-grams، واستخدام التدريب القائم على المشي العشوائي. لإدارة مجموعات البيانات الكبيرة، فإنه يدمج تحميل البيانات المضغوطة القائمة على القرص وتحسين أخذ العينات السلبية.

    Supports reading training data from compressed formats to minimize the disk footprint of large datasets.

    C++
    عرض على GitHub↗3,954
  1. Home
  2. Part of an Awesome List
  3. Media & Communication
  4. Video Processing
  5. Training Data Compression