awesome-repositories.com
Blog
MCP
awesome-repositories.com

Descubre los mejores repositorios open-source con nuestra búsqueda potenciada por IA.

ExplorarBúsquedas curadasAlternativas open-sourceSoftware autohospedableBlogMapa del sitio
ProyectoServidor MCPAcerca deCómo clasificamosPrensa
Aviso legalPrivacidadTérminos
© 2026 Bringes Technology SRL·VAT RO45896025·hello@awesome-repositories.com
·

3 repositorios

Awesome GitHub RepositoriesInference Routing Protocols

Specifies a content-level classification and semantic routing framework for AI inference systems as an IETF protocol.

Distinct from Routing Protocols: No candidate covers an IETF protocol specification for AI inference routing; closest are network routing protocols.

Explore 3 awesome GitHub repositories matching artificial intelligence & ml · Inference Routing Protocols. Refine with filters or upvote what's useful.

Awesome Inference Routing Protocols GitHub Repositories

Encuentra los mejores repositorios con IA.Buscaremos los repositorios que mejor coincidan usando IA.
  • kserve/kserveAvatar de kserve

    kserve/kserve

    5,576Ver en GitHub↗

    KServe is a Kubernetes-native platform for deploying and serving machine learning models as scalable inference services. It supports both generative AI models, including large language models, and traditional predictive models from frameworks such as TensorFlow, PyTorch, Scikit-Learn, XGBoost, and ONNX. The platform manages the full lifecycle of model deployments, including revision tracking, canary rollouts, A/B testing, and automatic rollbacks, and provides serverless scale-to-zero capabilities for cost-efficient resource management. KServe distinguishes itself through a standardized infere

    Standardizes inference requests and responses across REST and gRPC with health checking and metadata endpoints.

    Go
    Ver en GitHub↗5,576
  • seldonio/seldon-coreAvatar de SeldonIO

    SeldonIO/seldon-core

    4,752Ver en GitHub↗

    Seldon Core es un servidor de modelos de machine learning basado en Kubernetes y un framework de inferencia MLOps. Funciona como un motor de servicio multimodelo y orquestador de pipelines, empaquetando modelos como microservicios escalables que se exponen a través de APIs REST y gRPC estandarizadas. El proyecto se distingue por sus pipelines de inferencia basados en grafos que encadenan modelos y transformadores de datos en flujos de trabajo secuenciales. Optimiza la utilización del hardware mediante el servicio compartido multimodelo y estrategias de sobreasignación dinámica de memoria, mientras admite la experimentación en producción mediante enrutamiento de tráfico ponderado, pruebas A/B y despliegues shadow. El framework cubre una amplia gama de capacidades MLOps, incluyendo escalado automático basado en la demanda, procesamiento asíncrono de solicitudes mediante buses de mensajes y monitoreo integral para la deriva de datos, valores atípicos y explicabilidad de predicciones. También proporciona gestión de infraestructura para la configuración del tiempo de ejecución del modelo y comunicación segura mediante cifrado TLS en los planos de control y datos.

    Implements standardized REST and gRPC protocols for consistent request and response handling across different model runtimes.

    Goaiopsdeploymentkubernetes
    Ver en GitHub↗4,752
  • vllm-project/semantic-routerAvatar de vllm-project

    vllm-project/semantic-router

    3,205Ver en GitHub↗

    Specifies a content-level classification and semantic routing framework as an IETF protocol.

    Goai-gatewaybert-classificationfine-tuning
    Ver en GitHub↗3,205
  1. Home
  2. Artificial Intelligence & ML
  3. Inference Routing Protocols

Explorar subetiquetas

  • Standardized Inference ProtocolsStandardizes inference requests and responses across REST and gRPC with health checking and metadata endpoints. **Distinct from Inference Routing Protocols:** Distinct from Inference Routing Protocols: focuses on the protocol specification itself, not routing frameworks.
  • Standardized V2 ProtocolsStandardized V2 inference protocol supporting REST and gRPC, health checking, and rich metadata. **Distinct from Inference Routing Protocols:** Distinct from Inference Routing Protocols: focuses on the standardized V2 protocol specification, not routing frameworks.