14 dépôts
Using large language models to perform complex text transformations like translation and summarization.
Distinct from Text Summarization: Unlike specific tasks like summarization, this covers the architectural use of LLMs for multiple text processing types.
Explore 14 awesome GitHub repositories matching artificial intelligence & ml · LLM-Based Text Processing. Refine with filters or upvote what's useful.
openai-translator is a cross-platform translation tool and language learning utility available as a browser extension and desktop application. It functions as a client for large language model APIs to translate, summarize, and polish text across different digital environments. The project differentiates itself by integrating optical character recognition to translate text extracted from images and screenshots. It also includes a language learning workflow that allows users to save new vocabulary to a digital book and use text-to-speech synthesis for pronunciation. The tool provides broad tex
Implements the core engine for translation, summarization, and polishing using large language model APIs.
Nextai-translator is an AI-powered text processor and cross-platform translation application. Available as a desktop app and browser extension, it uses large language model APIs to translate, summarize, and refine multilingual content in real time. The tool integrates with clipboard managers and text selection utilities to trigger automated translations immediately after content is copied or highlighted. It also functions as an OCR translation utility, extracting and translating text from screenshots and non-selectable image content. Additional capabilities include a vocabulary management sy
Uses large language models to perform context-aware text transformations including translation and summarization.
ChatPaper is a suite of AI agents and utilities designed for academic literature automation, manuscript editing, and research assistance. The system functions as a research assistant that summarizes, translates, and analyzes scholarly papers, while providing specialized tools for converting academic PDFs into structured markdown to preserve formulas for analysis. The project features a literature survey automator that crawls research repositories and synthesizes domain reports, alongside a research mind map generator that transforms linear document content into non-linear node-based maps. It
Pipes extracted text from academic papers into LLMs for summarization, translation, and critical analysis.
anx-reader is a cross-platform e-book reader and cloud-synced library manager. It renders various electronic book formats into a standardized HTML view with customizable themes and fonts for a consistent experience across different operating systems. The project integrates a large language model as a reading assistant to summarize text and answer questions about book content. It also functions as a digital annotation tool for creating color-coded highlights and detailed notes for external research export. The system includes capabilities for organizing digital library collections, synchroniz
Integrates large language models to perform text processing tasks such as summarization and content analysis.
This project is a long context inference engine and optimizer designed to process infinite text streams using large language models without memory growth or performance degradation. It serves as a system for maintaining constant memory usage during the generation of text from arbitrarily long input sequences. The implementation utilizes a rolling key-value cache manager and attention sink mechanisms to stabilize the attention process during continuous stream processing. By retaining initial tokens and employing a sliding window of key-value pairs, the system enables constant-time inference an
Uses large language models to process and maintain context over massive volumes of text.
Bili.Copilot est un client de bureau Windows natif pour Bilibili qui intègre des modèles de langage étendus pour fournir une navigation média et un résumé vidéo améliorés par l'IA. Il fonctionne comme un navigateur média et un résumeur vidéo, permettant aux utilisateurs de générer des aperçus concis de vidéos et d'articles en traitant les sous-titres et le texte. L'application permet aux utilisateurs d'interagir avec des modèles d'IA pour interroger des informations spécifiques et évaluer le contenu au sein des vidéos. Ces capacités sont fournies via une interface Windows native construite avec le Windows App SDK et WinUI. Le logiciel couvre la gestion média et la consommation de contenu, incluant le téléchargement vidéo pour un visionnage hors ligne et un rendu de lecture intégré. Il gère également l'identité de l'utilisateur via une authentification basée sur QR et des méthodes de connexion basées sur le web.
Integrates large language models for complex text processing of subtitles and content.
Sparrow est une plateforme d'extraction de documents par LLM et un moteur d'inférence basé sur la vision, conçu pour convertir des images et des PDF en données structurées validées. Il fonctionne comme un orchestrateur de workflow agentique qui enchaîne des tâches de classification, d'extraction et de validation dans des pipelines multi-étapes. Le système se distingue par une couche d'inférence agnostique au backend qui gère les modèles sur des GPU locaux, Apple Silicon et des fournisseurs cloud. Il utilise le "visual grounding" basé sur les coordonnées pour mapper le texte extrait à des boîtes englobantes précises et utilise un guidage par indices pour orienter l'attention et normaliser les formats de données. La plateforme couvre les workflows d'intelligence documentaire, incluant le traitement spécialisé d'images de tableaux pour maintenir l'intégrité structurelle et une validation basée sur des schémas pour vérifier l'exactitude des champs extraits. Elle fournit également un tableau de bord d'analyse documentaire pour surveiller les performances de l'API, les statistiques d'utilisation et l'état du système. L'architecture inclut un système d'extension par plugins pour intégrer des bibliothèques tierces utilisées dans l'indexation et l'orchestration.
Executes text-based analysis, validation, and decision-making tasks using an inference API without document input.
Humanizer is a text processing system designed to remove machine-generated patterns from writing to make it sound more natural and conversational. It functions as an auditor and rewriter that identifies robotic signatures, formulaic tropes, and mechanical formatting in machine output. The project features a style-matching system that analyzes provided writing samples to replicate a user's specific sentence rhythms, vocabulary, and punctuation habits. This allows the tool to mirror a personal voice and apply a calibrated tone to the rewritten text. The system covers a broad range of linguisti
Removes machine patterns from LLM output to make AI-generated text sound more natural and conversational.
RedInk is an AI content automation tool designed to generate coordinated social media posts, including titles, body text, and matching visual assets, from a single user-provided topic. It functions as a stateless content pipeline that uses large language models to transform topics into structured marketing copy and image prompts. The system utilizes prompt-template orchestration to combine static instructions with dynamic inputs, guiding artificial intelligence toward specific output formats. Users can manage these AI behaviors and API preferences through a web-based settings interface that t
Implements a pipeline using large language models to transform topics into structured marketing text and image prompts.
CapsWriter-Offline is a suite of desktop tools that operates without an internet connection, combining local media browsing, voice dictation, audio and video transcription, and 360-degree media viewing into a single application. The project's core identity centers on providing offline functionality for both media handling and speech-to-text workflows. What distinguishes it is the integration of voice dictation with a persistent local storage layer that saves every audio recording and daily transcript logs, along with a rule-based text normalization engine that converts spoken number phrases a
Routes recognized speech to a language model for role-specific polishing based on predefined names.
Novel-Plus est un système de gestion de contenu et une plateforme de lecture en ligne conçue pour héberger, gérer et distribuer des romans web sur des interfaces PC et mobiles. Il fournit un environnement complet pour la publication de romans web, avec un lecteur multi-plateforme doté d'étagères, de thèmes personnalisables et de systèmes de commentaires communautaires. La plateforme intègre un robot d'indexation de contenu automatisé pour rassembler et mettre à jour les données littéraires à partir de sources distantes externes et emploie un système de stockage de texte évolutif utilisant le partitionnement de base de données et des fichiers plats pour gérer de grands volumes de contenu. Elle inclut également un assistant d'écriture intégré qui utilise des grands modèles de langage pour aider les auteurs à développer, polir et poursuivre leur texte, ainsi que des capacités d'IA pour générer des couvertures de romans. Le système couvre la monétisation du contenu numérique via une plateforme d'adhésion et de facturation pour gérer les abonnements payants et les paiements des auteurs. Les capacités supplémentaires incluent la gestion de contenu littéraire avec recherche par mots-clés et moteurs de recommandation, des analyses de performance en temps réel et des outils administratifs pour les opérations de plateforme et la modération de contenu.
Uses large language models to perform complex text transformations including expansion and polishing within the editor.
Ce projet est un scraper web pour Sina Weibo et un pipeline de données de réseaux sociaux conçu pour extraire les profils d'utilisateurs, les publications, les commentaires et les ressources multimédias. Il fonctionne comme un crawler de données conteneurisé qui automatise la collecte et le stockage local de contenu de réseaux sociaux et de métriques d'engagement. Le système inclut une couche de traitement qui utilise des modèles de langage étendus (LLM) pour analyser le texte extrait, générant des résumés et une analyse de sentiment. Il se distingue par un modèle de déploiement prêt à l'emploi sous forme de conteneur, doté d'une interface HTTP pour gérer les tâches d'extraction et surveiller la progression des travaux. Le crawler couvre un large éventail de capacités, incluant la surveillance des réseaux sociaux via des mises à jour incrémentales planifiées, l'archivage des ressources multimédias sur disques locaux et l'exportation de données multi-formats vers des fichiers plats ou des bases de données. Il capture également des interactions sociales détaillées, telles que les commentaires de premier niveau et les reposts.
Utilizes large language models to perform text transformations such as summarization and sentiment analysis.
This repository is a collection of node-based pipeline configurations, examples, and templates for generating AI media. It provides a workflow library and a curated gallery of blueprints designed for creating images, videos, and 3D assets using diffusion models. The project specifically offers a set of pre-configured node graphs for implementing advanced image generation and refinement techniques, with a focus on Stable Diffusion workflows. These examples demonstrate how to interconnect processing nodes to define complex generative logic without writing code. The available templates cover a
Utilizes external large language models to perform text-based chat and analysis.
Humanizer-zh is a tool designed to transform AI-generated content into natural-sounding writing by removing repetitive patterns and mechanical formatting. It functions as an AI content de-optimizer and text humanizer specifically focused on making Chinese text sound more human-authored. The project specializes in Chinese language refinement, replacing corporate jargon and artificial linguistic markers with native expressions and varied sentence rhythms. It employs a system to strip formulaic signatures and repetitive structures common in large language model outputs to increase perceived auth
Specializes in removing machine patterns and introducing conversational fluency to humanize AI text.