4 مستودعات
Grouping tasks into isolated namespaces based on topics to organize workflows and project isolation.
Distinct from Pipeline Task Grouping: Distinct from Pipeline Task Grouping: focuses on logical topic-based namespaces for organization rather than execution sequence wrapping.
Explore 4 awesome GitHub repositories matching software engineering & architecture · Topic-Based Partitioning. Refine with filters or upvote what's useful.
KnowledgeGraphData هي مجموعة من مجموعات البيانات المهيكلة والمصنفات المصممة لتوفير طبقة أساسية لأنظمة الذكاء المعرفي والذكاء الاصطناعي. تتكون بشكل أساسي من مجموعات بيانات رسوم بيانية معرفية صينية واسعة النطاق، بما في ذلك بيانات علاقة الكيانات ومجموعات تدريب NLP المستخدمة لدفع الفهم الدلالي والإجابة الآلية على الأسئلة. يركز المشروع على بناء وتصدير رسوم بيانية ضخمة للكيانات والسمات والقيم، وتنظيم المعرفة في تنسيقات محمولة. يوفر تقسيم نطاق متخصص لتخصيص استرجاع المعلومات للمجالات المهنية مثل الرعاية الصحية، والجيش، والأمن العام. يغطي المستودع مجموعة واسعة من القدرات بما في ذلك معالجة اللغة الطبيعية الصينية، والبحث الدلالي، وأنظمة الحوار المعرفي. تشمل مجموعة أدواته التحليل اللغوي، واستخراج الكيانات، واكتشاف المشاعر، وتلخيص النصوص، بالإضافة إلى تحليل المحتوى المرئي لتدقيق المواقع وتحويل الكلام إلى نص.
Organizes entity data into specialized professional domains to tailor information retrieval for specific industries.
Corpora هي مكتبة من مجموعات النصوص المنسقة والمحددة النطاق ومجموعات البيانات المهيكلة. توفر مجموعات من الأسماء والصفات والأفعال المصنفة بتنسيق JSON، مخصصة للاستخدام كبيانات تدريب أو اختبار ثابتة للوكلاء المحادثين والأنظمة المؤتمتة. ينظم المشروع البيانات اللغوية عبر مجالات متنوعة، بما في ذلك العلوم والفنون والجغرافيا. يتم توزيع مجموعات البيانات هذه كملفات مستقلة باستخدام مخطط محايد لغوياً ونموذج بيانات JSON ثابت، مما يسمح بالاستيراد المباشر إلى التطبيقات دون الحاجة إلى طبقة API. تدعم المكتبة إنشاء محتوى روبوتات الدردشة وتطوير النماذج الأولية السريع من خلال توفير تكامل بيانات مهيكل. وتستخدم تصنيف أجزاء الكلام وتقسيم البيانات الخاص بالمجال لتسهيل إنشاء الحوارات واختبار نماذج تعلم الآلة.
Organizes linguistic datasets into topical categories to ensure broad knowledge coverage for conversational agents.
Dooit is a terminal-based task manager that utilizes a text user interface to organize todo lists and project workflows. It functions as a topic-based todo list, grouping items into separate topics with branching support to ensure organized project isolation. The application is designed for a keyboard-driven workflow, employing Vim-inspired shortcuts for the navigation and manipulation of categorized task lists. It is a configurable TUI application that allows users to define operational behavior and visual themes through external configuration files. The system includes capabilities for tas
Implements topic-based task partitioning to group distinct sets of tasks into isolated namespaces for organized project workflows.
UltraChat is a collection of large-scale conversational datasets and instruction-tuning data designed for training and evaluating generative AI models. It provides structured JSON data consisting of complex, multi-round dialogue sequences intended to refine the performance of large language models in chat tasks. The project focuses on improving reasoning and response quality through a diverse set of interactions across multiple sectors. These datasets are used for supervised fine-tuning and instruction tuning workflows to improve how models follow complex directions and maintain context acros
Partitions training data into distinct industry and topical sectors to ensure broad knowledge coverage.