1 Repo
Identifying outliers by analyzing correlations and dependencies between multiple data dimensions.
Distinct from Anomaly Detection Algorithms: Shortlist is too generic (Algorithms) or specific (Callstacks); this refers to the ML-specific multi-dimensional approach.
Explore 1 awesome GitHub repository matching artificial intelligence & ml · Multivariate Anomaly Detection. Refine with filters or upvote what's useful.
Mmlspark ist ein verteiltes Framework zur Ausführung von Machine-Learning-Modellen, Datentransformationen und KI-Dienstintegrationen über Apache Spark-Cluster hinweg. Es fungiert als verteilte Machine-Learning-Bibliothek und Pipeline-Orchestrator, der es Benutzern ermöglicht, vortrainierte kognitive Dienste und benutzerdefinierte Modelle in großskalige Batch- und Streaming-Workflows zu integrieren. Das Projekt zeichnet sich durch die Fähigkeit aus, externe KI-Dienste und Web-APIs direkt in Big-Data-Pipelines für Text- und Bildanalysen einzubinden. Es bietet ein skalierbares Modelltrainings-Framework, das Gradient Boosting- und Klassifizierungsaufgaben über elastisch skalierbare Compute-Cluster koordiniert und Hardwarebeschleunigung für verteilte Modellinferenz nutzt. Das Toolset deckt ein breites Spektrum an Funktionen ab, einschließlich multimodaler Inhaltsanalyse für Bild, Sprache und Text sowie fortgeschrittener Anomalieerkennung für Zeitreihen- und multivariate Daten. Es enthält Dienstprogramme für Daten-Featurization, die Ausführung von ONNX-Modellen und Responsible-AI-Tools für Audits zur Modellfairness und Interpretierbarkeit von Vorhersagen mittels additiver Beitragswerte. Das Framework bietet zudem eine einheitliche Datenzugriffsschnittstelle zum Lesen und Schreiben über verschiedene Datenbanken und Cloud-Speichersysteme hinweg.
Identifies outliers across multiple variables by analyzing inter-correlations and dependencies between data dimensions.