awesome-repositories.com
Blog
MCP
awesome-repositories.com

Découvrez les meilleurs dépôts open-source grâce à notre recherche par IA.

ExplorerRecherches sélectionnéesAlternatives open sourceLogiciels auto-hébergésBlogPlan du site
ProjetÀ proposNotre méthodologiePresseServeur MCP
Mentions légalesConfidentialitéConditions d'utilisation
© 2026 Bringes Technology SRL·VAT RO45896025·hello@awesome-repositories.com
·
microsoft avatar

microsoft/SPTAG

0
View on GitHub↗
5,004 stars·618 forks·C++·MIT·5 vues

SPTAG

SPTAG est une bibliothèque de recherche de plus proches voisins approximatifs (ANN) par vecteur et un moteur de recherche vectorielle distribué. Il fournit un index vectoriel à grande échelle conçu pour organiser et récupérer des vecteurs similaires à partir de jeux de données massifs en utilisant une recherche de similarité haute performance et des requêtes de proximité.

Le système fonctionne comme un gestionnaire d'index vectoriel dynamique, prenant en charge les mises à jour, insertions et suppressions incrémentales de vecteurs sans nécessiter une reconstruction complète de l'index. Il met à l'échelle les opérations de recherche sur plusieurs machines pour gérer des jeux de données à grande échelle et des volumes élevés de requêtes en ligne grâce au traitement distribué des requêtes de recherche.

Le projet implémente des capacités de recherche et d'indexation en utilisant des arbres de partitionnement spatial et des graphes de voisinage relatif. Il effectue des recherches de plus proches voisins approximatifs via une traversée itérative de graphes et des calculs de métriques de distance pour localiser les vecteurs les plus proches d'un point de requête.

Features

  • Billion-Scale Vector Search - Provides high-performance approximate nearest neighbor search optimized for massive, billion-scale vector datasets.
  • Approximate Nearest Neighbor Search - Provides a library for high-performance retrieval using approximate nearest neighbor search algorithms.
  • Distributed Vector Stores - Scales vector search operations across multiple machines to handle extremely large datasets and online requests.
  • Graph Traversal - Uses iterative graph traversal to navigate connected vector nodes and find the nearest neighbors.
  • Vector Search Indexes - Implements high-performance data structures optimized for similarity search in high-dimensional vector spaces.
  • Vector Indexing - Provides tools for building and managing vector indices that support incremental updates without full rebuilds.
  • Dynamic Index Management - Supports incremental updates, insertions, and deletions of vectors without requiring a full index rebuild.
  • Distributed Engines - Functions as a distributed engine that scales horizontally across multiple nodes for massive datasets.
  • Vector Similarity Search - Retrieves vectors closest to a query point by calculating distance metrics through iterative traversal.
  • High-Dimensional - Divides high-dimensional space into recursive regions to narrow the search area for candidate vector matches.
  • Proximity Graphs - Builds relative neighborhood graphs to enable efficient greedy traversal during similarity searches.
  • Distributed Search Engines - Utilizes a distributed cluster architecture to scale similarity search operations for massive datasets.
  • Incremental Indexing Engines - Supports dynamic updates to large-scale vector indices without requiring a full re-indexing process.
  • Distributed Search Query Routing - Implements query routing across a cluster of machines to handle massive datasets while maintaining low latency.
  • Similarity Search - Library for fast approximate nearest neighbor search.

Historique des stars

Graphique de l'historique des stars pour microsoft/sptagGraphique de l'historique des stars pour microsoft/sptag

Recherche par IA

Explorez plus de dépôts awesome

Décrivez vos besoins en langage naturel — l'IA classe des milliers de projets open source sélectionnés par pertinence.

Start searching with AI

Questions fréquentes

Que fait microsoft/sptag ?

SPTAG est une bibliothèque de recherche de plus proches voisins approximatifs (ANN) par vecteur et un moteur de recherche vectorielle distribué. Il fournit un index vectoriel à grande échelle conçu pour organiser et récupérer des vecteurs similaires à partir de jeux de données massifs en utilisant une recherche de similarité haute performance et des requêtes de proximité.

Quelles sont les fonctionnalités principales de microsoft/sptag ?

Les fonctionnalités principales de microsoft/sptag sont : Billion-Scale Vector Search, Approximate Nearest Neighbor Search, Distributed Vector Stores, Graph Traversal, Vector Search Indexes, Vector Indexing, Dynamic Index Management, Distributed Engines.

Quelles sont les alternatives open-source à microsoft/sptag ?

Les alternatives open-source à microsoft/sptag incluent : lancedb/lancedb — LanceDB is a vector database and columnar data store designed to function as a versioned dataset manager and vector… unum-cloud/usearch — USearch is a high-performance vector similarity search engine and approximate nearest neighbor index designed for… alibaba/zvec — zvec is an embedded vector database engine and indexing library designed for high-dimensional similarity search. It… spotify/annoy — Annoy is a C++ library designed for approximate nearest neighbor search in high-dimensional vector spaces. It… nmslib/hnsw — This project is a C++ vector similarity engine and implementation of the Hierarchical Navigable Small World algorithm.… hora-search/hora — Hora is a vector similarity search library written in Rust designed for efficient approximate nearest neighbor…

Alternatives open source à SPTAG

Projets open source similaires, classés selon le nombre de fonctionnalités partagées avec SPTAG.
  • lancedb/lancedbAvatar de lancedb

    lancedb/lancedb

    9,031Voir sur GitHub↗

    LanceDB is a vector database and columnar data store designed to function as a versioned dataset manager and vector search engine. It serves as a high-performance backend for indexing and retrieving high-dimensional embeddings, providing the foundation for machine learning data pipelines. The system distinguishes itself through a combination of cloud-native object storage and immutable version tracking, allowing for data time-travel and reproducible AI experiments. It integrates hybrid search capabilities, merging dense vector similarity with BM25 full-text search and SQL-like scalar filters

    HTMLapproximate-nearest-neighbor-searchimage-searchnearest-neighbor-search
    Voir sur GitHub↗9,031
  • unum-cloud/usearchAvatar de unum-cloud

    unum-cloud/USearch

    3,888Voir sur GitHub↗

    USearch is a high-performance vector similarity search engine and approximate nearest neighbor index designed for dense embeddings. It functions as a low-level vector database core and high-dimensional vector indexer, providing the primitives necessary to store and retrieve vectors across massive datasets. The engine distinguishes itself through hardware-level SIMD acceleration for distance kernels and a proximity-graph indexing system that enables fast retrieval across billions of vectors. It supports multi-precision vector quantization to balance memory usage and accuracy, and utilizes memo

    C++approximate-nearest-neighbor-searchclusteringdatabase
    Voir sur GitHub↗3,888
  • alibaba/zvecAvatar de alibaba

    alibaba/zvec

    5,198Voir sur GitHub↗

    zvec is an embedded vector database engine and indexing library designed for high-dimensional similarity search. It functions as a hybrid search engine and a retrieval-augmented generation knowledge base, allowing for the storage and retrieval of dense and sparse vectors. The system is distinguished by its hybrid retrieval pipeline, which fuses vector similarity, full-text keyword matching, and scalar metadata filtering into single query operations. It supports a plugin-based model integration system for registering custom embedding models and rerankers, as well as language bindings for nativ

    C++ann-searchembedded-databaserag
    Voir sur GitHub↗5,198
  • spotify/annoyAvatar de spotify

    spotify/annoy

    14,157Voir sur GitHub↗

    Annoy is a C++ library designed for approximate nearest neighbor search in high-dimensional vector spaces. It functions as a vector similarity search engine that constructs static, disk-based data structures to facilitate fast lookups. By mapping identifiers to vector data and persisting these structures to disk, the library enables efficient, memory-mapped access to large datasets. The project distinguishes itself through the use of random projection trees and distance-metric-based partitioning, which organize data into hierarchical binary trees to balance search precision against computatio

    C++approximate-nearest-neighbor-searchc-plus-plusgolang
    Voir sur GitHub↗14,157
Voir les 30 alternatives à SPTAG→