awesome-repositories.com
Blog
MCP
awesome-repositories.com

Descoperă cele mai bune repository-uri open source cu căutare AI.

ExploreazăCăutări recomandateAlternative open-sourceSoftware self-hostedBlogHartă site
ProiectServer MCPDespreCum realizăm clasamentulPresă
LegalConfidențialitateTermeni
© 2026 Bringes Technology SRL·VAT RO45896025·hello@awesome-repositories.com
·
toshi-search avatar

toshi-search/Toshi

0
View on GitHub↗
4,251 stele·136 fork-uri·Rust·MIT·14 vizualizări

Toshi

Toshi este un motor de căutare full-text și o bibliotecă implementată în Rust, concepută pentru a gestiona și interoga seturi de date structurate la scară largă. Funcționează ca o platformă de căutare distribuită care permite recuperarea informațiilor de mare viteză din colecții masive de date.

Sistemul se distinge printr-o arhitectură construită pentru ingestie de mare capacitate și execuție paralelă a interogărilor. Utilizează un framework de concurență bazat pe actor-model pentru a coordona procesele worker și folosește sharding-ul distribuit pentru a partiționa segmentele de index pe mai multe noduri. Pentru a menține performanța și integritatea datelor, motorul automatizează gestionarea ciclului de viață al indexului, inclusiv fuziunea segmentelor în fundal și log-ul persistent de tip write-ahead.

Platforma oferă capabilități cuprinzătoare pentru gestionarea infrastructurii de căutare, inclusiv instrumente pentru scalarea clusterelor și optimizarea throughput-ului de ingestie. Se bazează pe stocarea indexului inversat și accesul la fișiere mapate în memorie pentru a optimiza operațiunile disc-memorie, asigurând o performanță de căutare consistentă pe măsură ce volumele de date cresc.

Features

  • Full-Text Search Engines - Implements a high-performance engine for indexing and retrieving information from large structured datasets.
  • Distributed Sharding Architectures - Partitions index segments across multiple nodes to achieve horizontal scalability and enable distributed query processing.
  • Full-Text Inverted Indexes - Maps document terms to their locations in a lookup structure to facilitate rapid full-text retrieval.
  • Write-Ahead Logging - Records document operations to a persistent journal before index updates to ensure data integrity and crash recovery.
  • Distributed Search Engines - Provides infrastructure for scaling search clusters across multiple nodes to handle massive data volumes.
  • High-Throughput Indexing - Optimizes the ingestion and storage of structured documents to maintain high performance as data collections grow.
  • Asynchronous Segment Merging - Performs background merging of immutable index segments to optimize disk space and maintain consistent search performance.
  • Distributed Search Query Routing - Distributes search requests across cluster nodes to retrieve relevant documents with high speed and reliability.
  • Index Lifecycle Management - Automates the lifecycle of search indexes, including segment merging and data commitment, to ensure long-term integrity.
  • Distributed Search Engines - Functions as a distributed platform for managing and querying massive collections of structured data.
  • Large Scale Indexing - Provides robust storage and indexing for massive datasets to ensure fast retrieval and accurate query results.
  • Search Libraries - Provides a search engine library implemented in Rust that optimizes ingestion throughput and memory allocation.
  • Actor-Based Concurrency - Coordinates worker processes using an actor-model framework to enable high-throughput document ingestion and parallel query execution.

Istoric stele

Graficul istoricului de stele pentru toshi-search/toshiGraficul istoricului de stele pentru toshi-search/toshi

Căutare AI

Explorează mai multe repository-uri excelente

Descrie ce ai nevoie în limbaj simplu — AI-ul sortează mii de proiecte open source selectate în funcție de relevanță.

Start searching with AI

Colecții curatoriate care includ Toshi

Colecții selectate manual în care apare Toshi.
  • Motoare de căutare self-hosted pentru site-uri
  • Alternative open source la Splunk
  • Motoare de căutare hibridă pentru RAG

Alternative open-source pentru Toshi

Proiecte open-source similare, clasificate după numărul de funcționalități comune cu Toshi.
  • elasticsearch/elasticsearchAvatar elasticsearch

    elasticsearch/elasticsearch

    77,171Vezi pe GitHub↗

    Elasticsearch is a distributed search engine and NoSQL document store designed for full-text search and real-time data retrieval. It functions as a RESTful data indexer and vector database, allowing for the storage and management of structured JSON documents across multiple nodes. The system distinguishes itself through its ability to serve as a log analytics platform for monitoring system health and security events. It incorporates vector search implementation using mathematical embeddings to support generative AI and augmented generation applications. The platform covers a broad range of c

    Java
    Vezi pe GitHub↗77,171
  • huichen/wukongAvatar huichen

    huichen/wukong

    4,481Vezi pe GitHub↗

    Wukong is a distributed full-text search engine designed for indexing and retrieving text documents. It functions as a customizable search backend that employs a BM25 relevance ranker to order search results based on term frequency and inverse document frequency. The system includes a specialized Chinese text segmenter to break continuous character strings into meaningful words for accurate indexing and retrieval. To handle large datasets and high request volumes, it utilizes a distributed search index that employs hash-based sharding to split documents across multiple nodes. The engine prov

    Go
    Vezi pe GitHub↗4,481
  • manticoresoftware/manticoresearchAvatar manticoresoftware

    manticoresoftware/manticoresearch

    11,819Vezi pe GitHub↗

    Manticoresearch is a high-performance search engine and database designed for indexing and retrieving large datasets. It functions as a full-text search engine, a vector search database, and a SQL-based search database, providing a distributed search cluster architecture. The system provides an alternative to the Elasticsearch stack, offering a compatible API for indexing and searching structured and unstructured data. It distinguishes itself by supporting multiple retrieval methods, including vector matching for similarity search, geospatial queries, and traditional full-text ranking. The p

    C++apibm25cpp
    Vezi pe GitHub↗11,819

Întrebări frecvente

Ce face toshi-search/toshi?
  • lnx-search/lnxAvatar lnx-search

    lnx-search/lnx

    1,443Vezi pe GitHub↗

    Lnx is a high-performance search engine and indexing database designed for managing large datasets. It provides a scalable infrastructure for full-text retrieval, allowing applications to process and query structured data with consistent responsiveness. The platform distinguishes itself through a schema-driven approach to data ingestion, which enforces structured field definitions to optimize storage and query precision. It incorporates advanced search capabilities, including fuzzy matching, spell correction, and similarity-based content recommendations, to ensure accurate results even with i

    Rustdatabaseinstantrust
    Vezi pe GitHub↗1,443
  • Vezi toate cele 30 alternative pentru Toshi→

    Toshi este un motor de căutare full-text și o bibliotecă implementată în Rust, concepută pentru a gestiona și interoga seturi de date structurate la scară largă. Funcționează ca o platformă de căutare distribuită care permite recuperarea informațiilor de mare viteză din colecții masive de date.

    Care sunt principalele funcționalități ale toshi-search/toshi?

    Principalele funcționalități ale toshi-search/toshi sunt: Full-Text Search Engines, Distributed Sharding Architectures, Full-Text Inverted Indexes, Write-Ahead Logging, Distributed Search Engines, High-Throughput Indexing, Asynchronous Segment Merging, Distributed Search Query Routing.

    Care sunt câteva alternative open-source pentru toshi-search/toshi?

    Alternativele open-source pentru toshi-search/toshi includ: elasticsearch/elasticsearch — Elasticsearch is a distributed search engine and NoSQL document store designed for full-text search and real-time data… huichen/wukong — Wukong is a distributed full-text search engine designed for indexing and retrieving text documents. It functions as a… manticoresoftware/manticoresearch — Manticoresearch is a high-performance search engine and database designed for indexing and retrieving large datasets.… lnx-search/lnx — Lnx is a high-performance search engine and indexing database designed for managing large datasets. It provides a… apache/lucene-solr — This project is a full text search engine and enterprise search infrastructure designed for indexing and retrieving… redisearch/redisearch — RediSearch is a Redis module that adds secondary indexing, full-text search, aggregation, and vector similarity search…