1 repository
Systematic side-by-side analysis of successive model releases across architecture, data, and benchmarks.
Distinct from Model Comparison Interfaces: Distinct from Model Comparison Interfaces: focuses on contrasting successive versions of the same model lineage, not arbitrary model outputs.
Explore 1 awesome GitHub repository matching artificial intelligence & ml · Model Version Comparisons. Refine with filters or upvote what's useful.
Deepchecks este un framework de validare a modelelor de machine learning și o bibliotecă de testare MLOps. Servește ca o suită de calitate a datelor AI și evaluator de performanță conceput pentru a verifica integritatea și performanța modelelor și seturilor de date, de la cercetare până la producție. Proiectul funcționează ca un instrument de monitorizare a modelelor pentru urmărirea derivei datelor (data drift) și a degradării performanței în mediile de producție. Permite crearea de suite de validare personalizate și utilizează o arhitectură de verificări pluggable pentru a automatiza testele de calitate în cadrul pipeline-urilor de integrare continuă (CI). Framework-ul acoperă o gamă largă de capabilități, inclusiv verificarea integrității datelor, detectarea derivei bazată pe distribuție și compararea versiunilor de modele. Oferă analiză specializată pentru computer vision și procesarea limbajului natural (NLP), alături de instrumente de raportare care transformă metricile de validare în rapoarte vizuale interactive. Sistemul suportă implementarea on-premises pentru a menține confidențialitatea datelor și controlul infrastructurii.
Evaluates and compares different model versions to determine the best performer during the development process.