4 repositorios
Grouping tasks into isolated namespaces based on topics to organize workflows and project isolation.
Distinct from Pipeline Task Grouping: Distinct from Pipeline Task Grouping: focuses on logical topic-based namespaces for organization rather than execution sequence wrapping.
Explore 4 awesome GitHub repositories matching software engineering & architecture · Topic-Based Partitioning. Refine with filters or upvote what's useful.
KnowledgeGraphData es una colección de conjuntos de datos estructurados y corpora diseñados para proporcionar una capa fundamental para sistemas de inteligencia cognitiva e inteligencia artificial. Consiste principalmente en conjuntos de datos de grafos de conocimiento chinos a gran escala, incluyendo datos de relación de entidades y conjuntos de entrenamiento de NLP utilizados para impulsar la comprensión semántica y la respuesta automática a preguntas. El proyecto se centra en la construcción y exportación de grafos masivos de entidad-atributo-valor, organizando el conocimiento en formatos portátiles. Proporciona partición de dominio especializada para adaptar la recuperación de información a campos profesionales como la salud, el ejército y la seguridad pública. El repositorio cubre una amplia gama de capacidades, incluyendo procesamiento de lenguaje natural en chino, búsqueda semántica y sistemas de diálogo cognitivo. Su conjunto de herramientas abarca análisis lingüístico, extracción de entidades, detección de sentimientos y resumen de texto, así como análisis de contenido visual para auditoría de sitios web y conversión de voz a texto.
Organizes entity data into specialized professional domains to tailor information retrieval for specific industries.
Corpora es una biblioteca de corpus de texto y conjuntos de datos estructurados, curados y específicos por dominio. Proporciona colecciones de sustantivos, adjetivos y verbos categorizados en formato JSON, destinados a ser utilizados como datos estáticos de entrenamiento o prueba para agentes conversacionales y sistemas automatizados. El proyecto organiza datos lingüísticos en diversos campos, incluyendo ciencia, arte y geografía. Estos conjuntos de datos se distribuyen como archivos independientes utilizando un esquema neutral al lenguaje y un modelo de datos JSON estático, lo que permite su importación directa en aplicaciones sin necesidad de una capa de API. La biblioteca admite la generación de contenido para chatbots y el desarrollo rápido de prototipos mediante la integración de datos estructurados. Utiliza la categorización de partes de la oración y la partición de datos por dominio para facilitar la creación de diálogos y la prueba de modelos de machine learning.
Organizes linguistic datasets into topical categories to ensure broad knowledge coverage for conversational agents.
Dooit is a terminal-based task manager that utilizes a text user interface to organize todo lists and project workflows. It functions as a topic-based todo list, grouping items into separate topics with branching support to ensure organized project isolation. The application is designed for a keyboard-driven workflow, employing Vim-inspired shortcuts for the navigation and manipulation of categorized task lists. It is a configurable TUI application that allows users to define operational behavior and visual themes through external configuration files. The system includes capabilities for tas
Implements topic-based task partitioning to group distinct sets of tasks into isolated namespaces for organized project workflows.
UltraChat is a collection of large-scale conversational datasets and instruction-tuning data designed for training and evaluating generative AI models. It provides structured JSON data consisting of complex, multi-round dialogue sequences intended to refine the performance of large language models in chat tasks. The project focuses on improving reasoning and response quality through a diverse set of interactions across multiple sectors. These datasets are used for supervised fine-tuning and instruction tuning workflows to improve how models follow complex directions and maintain context acros
Partitions training data into distinct industry and topical sectors to ensure broad knowledge coverage.