awesome-repositories.com
Blog
MCP
awesome-repositories.com

Descubre los mejores repositorios open-source con nuestra búsqueda potenciada por IA.

ExplorarBúsquedas curadasAlternativas open-sourceSoftware autohospedableBlogMapa del sitio
ProyectoServidor MCPAcerca deCómo clasificamosPrensa
Aviso legalPrivacidadTérminos
© 2026 Bringes Technology SRL·VAT RO45896025·hello@awesome-repositories.com
·

4 repositorios

Awesome GitHub RepositoriesTopic-Based Partitioning

Grouping tasks into isolated namespaces based on topics to organize workflows and project isolation.

Distinct from Pipeline Task Grouping: Distinct from Pipeline Task Grouping: focuses on logical topic-based namespaces for organization rather than execution sequence wrapping.

Explore 4 awesome GitHub repositories matching software engineering & architecture · Topic-Based Partitioning. Refine with filters or upvote what's useful.

Awesome Topic-Based Partitioning GitHub Repositories

Encuentra los mejores repositorios con IA.Buscaremos los repositorios que mejor coincidan usando IA.
  • ownthink/knowledgegraphdataAvatar de ownthink

    ownthink/KnowledgeGraphData

    5,181Ver en GitHub↗

    KnowledgeGraphData es una colección de conjuntos de datos estructurados y corpora diseñados para proporcionar una capa fundamental para sistemas de inteligencia cognitiva e inteligencia artificial. Consiste principalmente en conjuntos de datos de grafos de conocimiento chinos a gran escala, incluyendo datos de relación de entidades y conjuntos de entrenamiento de NLP utilizados para impulsar la comprensión semántica y la respuesta automática a preguntas. El proyecto se centra en la construcción y exportación de grafos masivos de entidad-atributo-valor, organizando el conocimiento en formatos portátiles. Proporciona partición de dominio especializada para adaptar la recuperación de información a campos profesionales como la salud, el ejército y la seguridad pública. El repositorio cubre una amplia gama de capacidades, incluyendo procesamiento de lenguaje natural en chino, búsqueda semántica y sistemas de diálogo cognitivo. Su conjunto de herramientas abarca análisis lingüístico, extracción de entidades, detección de sentimientos y resumen de texto, así como análisis de contenido visual para auditoría de sitios web y conversión de voz a texto.

    Organizes entity data into specialized professional domains to tailor information retrieval for specific industries.

    Python
    Ver en GitHub↗5,181
  • dariusk/corporaAvatar de dariusk

    dariusk/corpora

    5,099Ver en GitHub↗

    Corpora es una biblioteca de corpus de texto y conjuntos de datos estructurados, curados y específicos por dominio. Proporciona colecciones de sustantivos, adjetivos y verbos categorizados en formato JSON, destinados a ser utilizados como datos estáticos de entrenamiento o prueba para agentes conversacionales y sistemas automatizados. El proyecto organiza datos lingüísticos en diversos campos, incluyendo ciencia, arte y geografía. Estos conjuntos de datos se distribuyen como archivos independientes utilizando un esquema neutral al lenguaje y un modelo de datos JSON estático, lo que permite su importación directa en aplicaciones sin necesidad de una capa de API. La biblioteca admite la generación de contenido para chatbots y el desarrollo rápido de prototipos mediante la integración de datos estructurados. Utiliza la categorización de partes de la oración y la partición de datos por dominio para facilitar la creación de diálogos y la prueba de modelos de machine learning.

    Organizes linguistic datasets into topical categories to ensure broad knowledge coverage for conversational agents.

    JavaScriptbotscorpuslanguage
    Ver en GitHub↗5,099
  • dooit-org/dooitAvatar de dooit-org

    dooit-org/dooit

    2,900Ver en GitHub↗

    Dooit is a terminal-based task manager that utilizes a text user interface to organize todo lists and project workflows. It functions as a topic-based todo list, grouping items into separate topics with branching support to ensure organized project isolation. The application is designed for a keyboard-driven workflow, employing Vim-inspired shortcuts for the navigation and manipulation of categorized task lists. It is a configurable TUI application that allows users to define operational behavior and visual themes through external configuration files. The system includes capabilities for tas

    Implements topic-based task partitioning to group distinct sets of tasks into isolated namespaces for organized project workflows.

    Pythonclipython3rich
    Ver en GitHub↗2,900
  • thunlp/ultrachatAvatar de thunlp

    thunlp/UltraChat

    2,786Ver en GitHub↗

    UltraChat is a collection of large-scale conversational datasets and instruction-tuning data designed for training and evaluating generative AI models. It provides structured JSON data consisting of complex, multi-round dialogue sequences intended to refine the performance of large language models in chat tasks. The project focuses on improving reasoning and response quality through a diverse set of interactions across multiple sectors. These datasets are used for supervised fine-tuning and instruction tuning workflows to improve how models follow complex directions and maintain context acros

    Partitions training data into distinct industry and topical sectors to ensure broad knowledge coverage.

    Pythonchatbotchatgptdeep-learning
    Ver en GitHub↗2,786
  1. Home
  2. Software Engineering & Architecture
  3. Asynchronous Task Managers
  4. Task Group Orchestration
  5. Pipeline Task Grouping
  6. Topic-Based Partitioning

Explorar subetiquetas

  • Knowledge Domain PartitioningDividing datasets into topical or industry-specific categories to ensure broad coverage. **Distinct from Topic-Based Partitioning:** Focuses on knowledge diversity in training sets rather than task-grouping in orchestration pipelines.