awesome-repositories.com
Blog
MCP
awesome-repositories.com

Descubre los mejores repositorios open-source con nuestra búsqueda potenciada por IA.

ExplorarBúsquedas curadasAlternativas open-sourceSoftware autohospedableBlogMapa del sitio
ProyectoServidor MCPAcerca deCómo clasificamosPrensa
Aviso legalPrivacidadTérminos
© 2026 Bringes Technology SRL·VAT RO45896025·hello@awesome-repositories.com
·
toshi-search avatar

toshi-search/Toshi

0
View on GitHub↗
4,251 estrellas·136 forks·Rust·MIT·14 vistas

Toshi

Toshi es un motor de búsqueda de texto completo y biblioteca implementada en Rust, diseñada para gestionar y consultar conjuntos de datos estructurados a gran escala. Funciona como una plataforma de búsqueda distribuida que permite la recuperación de información de alta velocidad a través de colecciones masivas de datos.

El sistema se distingue por una arquitectura construida para la ingesta de alto rendimiento y la ejecución de consultas en paralelo. Utiliza un framework de concurrencia basado en el modelo de actores para coordinar procesos de trabajo y emplea fragmentación (sharding) distribuida para particionar segmentos de índice a través de múltiples nodos. Para mantener el rendimiento y la integridad de los datos, el motor automatiza la gestión del ciclo de vida del índice, incluyendo la fusión de segmentos en segundo plano y el registro de escritura anticipada (write-ahead logging) persistente.

La plataforma proporciona capacidades integrales para gestionar la infraestructura de búsqueda, incluyendo herramientas para escalar clústeres y ajustar el rendimiento de la ingesta. Se basa en el almacenamiento de índices invertidos y el acceso a archivos mapeados en memoria para optimizar las operaciones de disco a memoria, asegurando un rendimiento de búsqueda consistente a medida que crecen los volúmenes de datos.

Features

  • Full-Text Search Engines - Implements a high-performance engine for indexing and retrieving information from large structured datasets.
  • Distributed Sharding Architectures - Partitions index segments across multiple nodes to achieve horizontal scalability and enable distributed query processing.
  • Full-Text Inverted Indexes - Maps document terms to their locations in a lookup structure to facilitate rapid full-text retrieval.
  • Write-Ahead Logging - Records document operations to a persistent journal before index updates to ensure data integrity and crash recovery.
  • Distributed Search Engines - Provides infrastructure for scaling search clusters across multiple nodes to handle massive data volumes.
  • High-Throughput Indexing - Optimizes the ingestion and storage of structured documents to maintain high performance as data collections grow.
  • Asynchronous Segment Merging - Performs background merging of immutable index segments to optimize disk space and maintain consistent search performance.
  • Distributed Search Query Routing - Distributes search requests across cluster nodes to retrieve relevant documents with high speed and reliability.
  • Index Lifecycle Management - Automates the lifecycle of search indexes, including segment merging and data commitment, to ensure long-term integrity.
  • Distributed Search Engines - Functions as a distributed platform for managing and querying massive collections of structured data.
  • Large Scale Indexing - Provides robust storage and indexing for massive datasets to ensure fast retrieval and accurate query results.
  • Search Libraries - Provides a search engine library implemented in Rust that optimizes ingestion throughput and memory allocation.
  • Actor-Based Concurrency - Coordinates worker processes using an actor-model framework to enable high-throughput document ingestion and parallel query execution.

Historial de estrellas

Gráfico del historial de estrellas de toshi-search/toshiGráfico del historial de estrellas de toshi-search/toshi

Búsqueda con IA

Explora más repositorios increíbles

Describe lo que necesitas en lenguaje sencillo: la IA clasifica miles de proyectos open-source curados por relevancia.

Start searching with AI

Colecciones destacadas con Toshi

Colecciones seleccionadas manualmente donde aparece Toshi.
  • Motores de búsqueda para sitios web autohospedados
  • Alternativas a Splunk open source
  • Motores de búsqueda híbrida para RAG

Alternativas open-source a Toshi

Proyectos open-source similares, clasificados según cuántas características comparten con Toshi.
  • elasticsearch/elasticsearchAvatar de elasticsearch

    elasticsearch/elasticsearch

    77,171Ver en GitHub↗

    Elasticsearch is a distributed search engine and NoSQL document store designed for full-text search and real-time data retrieval. It functions as a RESTful data indexer and vector database, allowing for the storage and management of structured JSON documents across multiple nodes. The system distinguishes itself through its ability to serve as a log analytics platform for monitoring system health and security events. It incorporates vector search implementation using mathematical embeddings to support generative AI and augmented generation applications. The platform covers a broad range of c

    Java
    Ver en GitHub↗77,171
  • huichen/wukongAvatar de huichen

    huichen/wukong

    4,481Ver en GitHub↗

    Wukong is a distributed full-text search engine designed for indexing and retrieving text documents. It functions as a customizable search backend that employs a BM25 relevance ranker to order search results based on term frequency and inverse document frequency. The system includes a specialized Chinese text segmenter to break continuous character strings into meaningful words for accurate indexing and retrieval. To handle large datasets and high request volumes, it utilizes a distributed search index that employs hash-based sharding to split documents across multiple nodes. The engine prov

    Go
    Ver en GitHub↗4,481
  • manticoresoftware/manticoresearchAvatar de manticoresoftware

    manticoresoftware/manticoresearch

    11,819Ver en GitHub↗

    Manticoresearch is a high-performance search engine and database designed for indexing and retrieving large datasets. It functions as a full-text search engine, a vector search database, and a SQL-based search database, providing a distributed search cluster architecture. The system provides an alternative to the Elasticsearch stack, offering a compatible API for indexing and searching structured and unstructured data. It distinguishes itself by supporting multiple retrieval methods, including vector matching for similarity search, geospatial queries, and traditional full-text ranking. The p

    C++apibm25cpp
    Ver en GitHub↗11,819
  • lnx-search/lnxAvatar de lnx-search

    lnx-search/lnx

    1,443Ver en GitHub↗

    Lnx is a high-performance search engine and indexing database designed for managing large datasets. It provides a scalable infrastructure for full-text retrieval, allowing applications to process and query structured data with consistent responsiveness. The platform distinguishes itself through a schema-driven approach to data ingestion, which enforces structured field definitions to optimize storage and query precision. It incorporates advanced search capabilities, including fuzzy matching, spell correction, and similarity-based content recommendations, to ensure accurate results even with i

    Rustdatabaseinstantrust
    Ver en GitHub↗1,443
Ver las 30 alternativas a Toshi→

Preguntas frecuentes

¿Qué hace toshi-search/toshi?

Toshi es un motor de búsqueda de texto completo y biblioteca implementada en Rust, diseñada para gestionar y consultar conjuntos de datos estructurados a gran escala. Funciona como una plataforma de búsqueda distribuida que permite la recuperación de información de alta velocidad a través de colecciones masivas de datos.

¿Cuáles son las características principales de toshi-search/toshi?

Las características principales de toshi-search/toshi son: Full-Text Search Engines, Distributed Sharding Architectures, Full-Text Inverted Indexes, Write-Ahead Logging, Distributed Search Engines, High-Throughput Indexing, Asynchronous Segment Merging, Distributed Search Query Routing.

¿Qué alternativas de código abierto existen para toshi-search/toshi?

Las alternativas de código abierto para toshi-search/toshi incluyen: elasticsearch/elasticsearch — Elasticsearch is a distributed search engine and NoSQL document store designed for full-text search and real-time data… huichen/wukong — Wukong is a distributed full-text search engine designed for indexing and retrieving text documents. It functions as a… manticoresoftware/manticoresearch — Manticoresearch is a high-performance search engine and database designed for indexing and retrieving large datasets.… lnx-search/lnx — Lnx is a high-performance search engine and indexing database designed for managing large datasets. It provides a… apache/lucene-solr — This project is a full text search engine and enterprise search infrastructure designed for indexing and retrieving… redisearch/redisearch — RediSearch is a Redis module that adds secondary indexing, full-text search, aggregation, and vector similarity search…