3 repositorios
Infrastructure for exposing AI orchestration workflows as accessible web services.
Distinct from AI Services: Focuses on serving the orchestration workflow itself rather than individual model inference or general AI services
Explore 3 awesome GitHub repositories matching artificial intelligence & ml · AI Workflow Serving. Refine with filters or upvote what's useful.
JARVIS is a system for large language model task orchestration, deployment management, and automation benchmarking. It utilizes a task orchestrator to decompose complex requests into actionable steps and coordinates various expert models to synthesize final responses. The project includes an AI model deployment manager to handle the local deployment of expert models across different hardware scales. It further provides an AI workflow API consisting of web endpoints used to trigger automated task workflows and retrieve results from model selection stages. The framework incorporates an automat
Creates web endpoints to trigger AI workflows and retrieve intermediate results from model selection stages.
Mmlspark es un framework distribuido para ejecutar modelos de machine learning, transformaciones de datos e integraciones de servicios de IA a través de clústeres de Apache Spark. Funciona como una biblioteca de machine learning distribuida y orquestador de pipelines, permitiendo a los usuarios integrar servicios cognitivos preentrenados y modelos personalizados en flujos de trabajo de procesamiento por lotes y streaming a gran escala. El proyecto se distingue por su capacidad para incorporar servicios de IA externos y API web directamente en pipelines de big data para análisis de texto y visión. Proporciona un framework de entrenamiento de modelos escalable que coordina tareas de potenciación de gradiente (gradient boosting) y clasificación a través de clústeres de cómputo elásticamente redimensionables, utilizando aceleración por hardware para la inferencia de modelos distribuida. El conjunto de herramientas cubre una amplia gama de capacidades, incluyendo análisis de contenido multimodal para imagen, voz y texto, así como detección de anomalías avanzada para datos de series temporales y multivariados. Incluye utilidades para la featurización de datos, la ejecución de modelos ONNX y herramientas de IA responsable para la auditoría de equidad de modelos y la interpretación de predicciones utilizando valores de contribución aditivos. El framework también proporciona una interfaz de acceso a datos unificada para leer y escribir a través de diversas bases de datos y sistemas de almacenamiento en la nube.
Exposes distributed computations as low-latency web services for real-time inference.
Olares is a comprehensive suite of self-hosted identity, storage, AI, and orchestration services designed for private infrastructure management. It functions as a Kubernetes home server orchestrator, enabling the deployment of containerized applications, AI models, and GPU resources on local hardware to replace third-party cloud services. The platform distinguishes itself through a combination of self-hosted AI infrastructure for running large language models and image generators, alongside a decentralized identity manager that uses cryptographic keys and OIDC for trustless authentication. It
Hosts AI models to coordinate complex agent tasks and provide retrieval-augmented generation as a web service.