awesome-repositories.com
Blog
MCP
awesome-repositories.com

Descoperă cele mai bune repository-uri open source cu căutare AI.

ExploreazăCăutări recomandateAlternative open-sourceSoftware self-hostedBlogHartă site
ProiectDespreCum realizăm clasamentulPresăServer MCP
LegalConfidențialitateTermeni
© 2026 Bringes Technology SRL·VAT RO45896025·hello@awesome-repositories.com
·
microsoft avatar

microsoft/SPTAG

0
View on GitHub↗
5,004 stele·618 fork-uri·C++·MIT·6 vizualizări

SPTAG

SPTAG este o bibliotecă de căutare a celui mai apropiat vecin aproximativ (vector approximate nearest neighbor) și un motor de căutare vectorială distribuit. Oferă un index vectorial la scară largă conceput pentru a organiza și regăsi vectori similari din seturi de date masive folosind căutarea de similaritate de înaltă performanță și interogări de proximitate.

Sistemul funcționează ca un manager dinamic de index vectorial, suportând actualizări incrementale, inserări și ștergeri de vectori fără a necesita o reconstrucție completă a indexului. Scalează operațiunile de căutare pe mai multe mașini pentru a gestiona seturi de date la scară largă și volume mari de cereri online prin gestionarea distribuită a cererilor de căutare.

Proiectul implementează capabilități de căutare și indexare folosind arbori de partiționare a spațiului și grafuri de vecinătate relativă. Efectuează căutări de tip cel mai apropiat vecin aproximativ prin parcurgerea iterativă a grafului și calcule de metrici de distanță pentru a localiza vectorii cei mai apropiați de un punct de interogare.

Features

  • Billion-Scale Vector Search - Provides high-performance approximate nearest neighbor search optimized for massive, billion-scale vector datasets.
  • Approximate Nearest Neighbor Search - Provides a library for high-performance retrieval using approximate nearest neighbor search algorithms.
  • Distributed Vector Stores - Scales vector search operations across multiple machines to handle extremely large datasets and online requests.
  • Graph Traversal - Uses iterative graph traversal to navigate connected vector nodes and find the nearest neighbors.
  • Vector Search Indexes - Implements high-performance data structures optimized for similarity search in high-dimensional vector spaces.
  • Vector Indexing - Provides tools for building and managing vector indices that support incremental updates without full rebuilds.
  • Dynamic Index Management - Supports incremental updates, insertions, and deletions of vectors without requiring a full index rebuild.
  • Distributed Engines - Functions as a distributed engine that scales horizontally across multiple nodes for massive datasets.
  • Vector Similarity Search - Retrieves vectors closest to a query point by calculating distance metrics through iterative traversal.
  • High-Dimensional - Divides high-dimensional space into recursive regions to narrow the search area for candidate vector matches.
  • Proximity Graphs - Builds relative neighborhood graphs to enable efficient greedy traversal during similarity searches.
  • Distributed Search Engines - Utilizes a distributed cluster architecture to scale similarity search operations for massive datasets.
  • Incremental Indexing Engines - Supports dynamic updates to large-scale vector indices without requiring a full re-indexing process.
  • Distributed Search Query Routing - Implements query routing across a cluster of machines to handle massive datasets while maintaining low latency.
  • Similarity Search - Library for fast approximate nearest neighbor search.

Istoric stele

Graficul istoricului de stele pentru microsoft/sptagGraficul istoricului de stele pentru microsoft/sptag

Căutare AI

Explorează mai multe repository-uri excelente

Descrie ce ai nevoie în limbaj simplu — AI-ul sortează mii de proiecte open source selectate în funcție de relevanță.

Start searching with AI

Întrebări frecvente

Ce face microsoft/sptag?

SPTAG este o bibliotecă de căutare a celui mai apropiat vecin aproximativ (vector approximate nearest neighbor) și un motor de căutare vectorială distribuit. Oferă un index vectorial la scară largă conceput pentru a organiza și regăsi vectori similari din seturi de date masive folosind căutarea de similaritate de înaltă performanță și interogări de proximitate.

Care sunt principalele funcționalități ale microsoft/sptag?

Principalele funcționalități ale microsoft/sptag sunt: Billion-Scale Vector Search, Approximate Nearest Neighbor Search, Distributed Vector Stores, Graph Traversal, Vector Search Indexes, Vector Indexing, Dynamic Index Management, Distributed Engines.

Care sunt câteva alternative open-source pentru microsoft/sptag?

Alternativele open-source pentru microsoft/sptag includ: lancedb/lancedb — LanceDB is a vector database and columnar data store designed to function as a versioned dataset manager and vector… unum-cloud/usearch — USearch is a high-performance vector similarity search engine and approximate nearest neighbor index designed for… alibaba/zvec — zvec is an embedded vector database engine and indexing library designed for high-dimensional similarity search. It… spotify/annoy — Annoy is a C++ library designed for approximate nearest neighbor search in high-dimensional vector spaces. It… nmslib/hnsw — This project is a C++ vector similarity engine and implementation of the Hierarchical Navigable Small World algorithm.… hora-search/hora — Hora is a vector similarity search library written in Rust designed for efficient approximate nearest neighbor…

Alternative open-source pentru SPTAG

Proiecte open-source similare, clasificate după numărul de funcționalități comune cu SPTAG.
  • lancedb/lancedbAvatar lancedb

    lancedb/lancedb

    9,031Vezi pe GitHub↗

    LanceDB is a vector database and columnar data store designed to function as a versioned dataset manager and vector search engine. It serves as a high-performance backend for indexing and retrieving high-dimensional embeddings, providing the foundation for machine learning data pipelines. The system distinguishes itself through a combination of cloud-native object storage and immutable version tracking, allowing for data time-travel and reproducible AI experiments. It integrates hybrid search capabilities, merging dense vector similarity with BM25 full-text search and SQL-like scalar filters

    HTMLapproximate-nearest-neighbor-searchimage-searchnearest-neighbor-search
    Vezi pe GitHub↗9,031
  • unum-cloud/usearchAvatar unum-cloud

    unum-cloud/USearch

    3,888Vezi pe GitHub↗

    USearch is a high-performance vector similarity search engine and approximate nearest neighbor index designed for dense embeddings. It functions as a low-level vector database core and high-dimensional vector indexer, providing the primitives necessary to store and retrieve vectors across massive datasets. The engine distinguishes itself through hardware-level SIMD acceleration for distance kernels and a proximity-graph indexing system that enables fast retrieval across billions of vectors. It supports multi-precision vector quantization to balance memory usage and accuracy, and utilizes memo

    C++approximate-nearest-neighbor-searchclusteringdatabase
    Vezi pe GitHub↗3,888
  • alibaba/zvecAvatar alibaba

    alibaba/zvec

    5,198Vezi pe GitHub↗

    zvec is an embedded vector database engine and indexing library designed for high-dimensional similarity search. It functions as a hybrid search engine and a retrieval-augmented generation knowledge base, allowing for the storage and retrieval of dense and sparse vectors. The system is distinguished by its hybrid retrieval pipeline, which fuses vector similarity, full-text keyword matching, and scalar metadata filtering into single query operations. It supports a plugin-based model integration system for registering custom embedding models and rerankers, as well as language bindings for nativ

    C++ann-searchembedded-databaserag
    Vezi pe GitHub↗5,198
  • spotify/annoyAvatar spotify

    spotify/annoy

    14,157Vezi pe GitHub↗

    Annoy is a C++ library designed for approximate nearest neighbor search in high-dimensional vector spaces. It functions as a vector similarity search engine that constructs static, disk-based data structures to facilitate fast lookups. By mapping identifiers to vector data and persisting these structures to disk, the library enables efficient, memory-mapped access to large datasets. The project distinguishes itself through the use of random projection trees and distance-metric-based partitioning, which organize data into hierarchical binary trees to balance search precision against computatio

    C++approximate-nearest-neighbor-searchc-plus-plusgolang
    Vezi pe GitHub↗14,157
Vezi toate cele 30 alternative pentru SPTAG→