1 रिपॉजिटरी
Preprocessing pipelines specifically for extracting 2D and 3D skeletal joint information from video.
Distinct from Multimodal Pre-Processing: Focuses on skeletal keypoints and pose data rather than general multimodal tensor conversion
Explore 1 awesome GitHub repository matching data & databases · Skeletal Pose Pre-processing. Refine with filters or upvote what's useful.
mmaction2 एक PyTorch वीडियो अंडरस्टैंडिंग टूलबॉक्स है जिसे डीप लर्निंग मॉडल्स को प्रशिक्षित और मूल्यांकन करने के लिए डिज़ाइन किया गया है। यह एक्शन रिकग्निशन, टेम्पोरल लोकलाइजेशन और स्पैटियो-टेम्पोरल एक्शन डिटेक्शन के लिए एक फ्रेमवर्क के रूप में कार्य करता है, जो पिक्सेल-आधारित वीडियो विश्लेषण और कंकाल-आधारित एक्शन रिकग्निशन दोनों के लिए विशेष टूल्स प्रदान करता है। यह प्रोजेक्ट रजिस्ट्री-आधारित घटक खोज और पदानुक्रमित, कॉन्फ़िगरेशन-संचालित मॉडल असेंबली की विशेषता वाले मॉड्यूलर आर्किटेक्चर के माध्यम से खुद को अलग करता है। यह मल्टी-मोडल फीचर फ्यूजन का समर्थन करता है, RGB फ्रेम्स, ऑप्टिकल फ्लो और ऑडियो को एकीकृत करता है, और टेक्स्ट-टू-वीडियो क्लिप रिट्रीवल और ज़ीरो-शॉट वीडियो भविष्यवाणी के लिए क्षमताएं शामिल करता है। व्यापक रूप से, यह फ्रेमवर्क वीडियो डेटासेट इंजीनियरिंग को कवर करता है, जिसमें एनोटेशन मानकीकरण और फ्रेम सैंपलिंग, साथ ही व्यापक मॉडल प्रशिक्षण और मूल्यांकन शामिल है। यह डिस्ट्रीब्यूटेड प्रशिक्षण, नॉलेज डिस्टिलेशन और मॉडल रिपैरामीट्राइजेशन के माध्यम से इन्फरेंस ऑप्टिमाइज़ेशन के लिए यूटिलिटीज प्रदान करता है। कोडबेस विभिन्न कंप्यूट नोड्स में डिप्लॉयमेंट के लिए ONNX मॉडल एक्सपोर्ट और एनवायरनमेंट कंटेनरीकरण का समर्थन करता है।
Extracts and processes 3D and 2D skeletal pose information from video for pose-based recognition.