awesome-repositories.com
Blog
MCP
awesome-repositories.com

Descubre los mejores repositorios open-source con nuestra búsqueda potenciada por IA.

ExplorarBúsquedas curadasAlternativas open-sourceSoftware autohospedableBlogMapa del sitio
ProyectoAcerca deCómo clasificamosPrensaServidor MCP
Aviso legalPrivacidadTérminos
© 2026 Bringes Technology SRL·VAT RO45896025·hello@awesome-repositories.com
·
agermanidis avatar

agermanidis/autosub

0
View on GitHub↗
4,197 estrellas·1,635 forks·Python·MIT·5 vistas

Autosub

Autosub es un procesador de medios por línea de comandos y generador automático de subtítulos que convierte flujos de audio de archivos de video y audio en superposiciones de texto temporizadas. Funciona como un conversor de voz a texto basado en IA que utiliza OpenAI Whisper para generar subtítulos sincronizados.

La herramienta incluye un pipeline de traducción de idiomas para convertir el habla transcrita a otros idiomas, permitiendo el subtitulado multilingüe de videos. Gestiona todo el proceso, desde la extracción del flujo de audio hasta la serialización de los archivos de subtítulos finales para su almacenamiento local.

El sistema cubre la transcripción de audio a texto, el mapeo de texto con marcas de tiempo y el procesamiento de medios basado en terminal.

Features

  • Automated Subtitle Generators - Provides an automated workflow that combines speech recognition and subtitle embedding for video files.
  • Language Translation Services - Passes transcribed text through a translation service to support multilingual subtitles.
  • Speech Recognition APIs - Integrates with speech recognition APIs to convert audio data into timed text segments.
  • Speech-to-Text Converters - Converts audio streams into text and supports translating transcriptions into different languages.
  • Whisper-Based Engines - Utilizes the OpenAI Whisper architecture to generate synchronized subtitles from audio and video files.
  • Speech to Text Transcription - Converts audio from media files into processed text with precise timestamps.
  • Automated Video Subtitling - Implements an AI-driven pipeline that combines transcription and translation to generate timed captions.
  • Timed Text Tracks - Synchronizes transcribed text with specific start and end timestamps for video playback.
  • Subtitle Translation - Translates transcribed speech into target languages specifically for video subtitles and captions.
  • Command-Line Media Processors - Provides a terminal-based application for automating the creation of subtitle files from various video formats.
  • Media Processing - Provides a terminal interface for manipulating and processing audio and video media files.
  • Multilingual Captioning - Generates and times subtitles in multiple languages for international audiences.
  • Machine Learning Projects - Automated speech recognition and subtitle generation for video files.
  • Media Automation - Command-line utility for auto-generating video subtitles.

Historial de estrellas

Gráfico del historial de estrellas de agermanidis/autosubGráfico del historial de estrellas de agermanidis/autosub

Búsqueda con IA

Explora más repositorios increíbles

Describe lo que necesitas en lenguaje sencillo: la IA clasifica miles de proyectos open-source curados por relevancia.

Start searching with AI

Alternativas open-source a Autosub

Proyectos open-source similares, clasificados según cuántas características comparten con Autosub.
  • linyqh/narratoaiAvatar de linyqh

    linyqh/NarratoAI

    8,091Ver en GitHub↗

    NarratoAI is an automated video production pipeline that uses large language models to generate scripts, voiceovers, and edited video commentary. It functions as a combined scriptwriter, voiceover generator, and video editor to streamline the creation of movie and television commentary content. The system automates the production workflow by converting input data into structured narrative scripts, synthesizing artificial speech for narration, and programmatically assembling video clips based on script timestamps. It also converts spoken audio from video files into written text for subtitles a

    Pythonaiagentaiopsgemini-api
    Ver en GitHub↗8,091
  • umlx5h/llplayerAvatar de umlx5h

    umlx5h/LLPlayer

    3,110Ver en GitHub↗

    LLPlayer is a language learning media player and AI subtitle generator that integrates large language models for real-time audio transcription and translation. It functions as an LLM-integrated video player and SRT transcription tool, utilizing local or remote AI models to generate text subtitles from audio and video streams. The project distinguishes itself through a contextual translation workflow that sends preceding subtitle lines to language models to maintain conversational flow and sentence structure. It also includes an optical character recognition system to convert bitmap-based subt

    C#asrcsharpflyleaf
    Ver en GitHub↗3,110
  • tmoroney/auto-subsAvatar de tmoroney

    tmoroney/auto-subs

    2,851Ver en GitHub↗

    Auto-subs is an AI transcription and automatic captioning tool that converts spoken audio from video files into synchronized subtitles. It functions as a subtitle generator and a transcription bridge, enabling the conversion of speech to text with automatic speaker identification and multi-language translation support. The software prioritizes data privacy by utilizing on-device AI inference to process audio and video files locally on the user's hardware. It distinguishes itself by offering deep integration with professional video editing workflows, allowing users to export timing and transcr

    TypeScriptaidavincidavinci-resolve
    Ver en GitHub↗2,851
  • wxbool/video-srt-windowsAvatar de wxbool

    wxbool/video-srt-windows

    5,037Ver en GitHub↗

    This is a Windows application for automatic speech recognition that transcribes spoken audio from video files into timestamped SRT subtitle files. It serves as a subtitle generator and translation tool that converts media speech into synchronized text. The software functions as a batch media transcriber, allowing the simultaneous processing of multiple audio and video files to generate subtitles in bulk. It includes a translation workflow to convert transcriptions between different languages for the creation of bilingual or localized files. The system also provides text refinement capabiliti

    Goffmpeggogolang
    Ver en GitHub↗5,037
Ver las 30 alternativas a Autosub→

Preguntas frecuentes

¿Qué hace agermanidis/autosub?

Autosub es un procesador de medios por línea de comandos y generador automático de subtítulos que convierte flujos de audio de archivos de video y audio en superposiciones de texto temporizadas. Funciona como un conversor de voz a texto basado en IA que utiliza OpenAI Whisper para generar subtítulos sincronizados.

¿Cuáles son las características principales de agermanidis/autosub?

Las características principales de agermanidis/autosub son: Automated Subtitle Generators, Language Translation Services, Speech Recognition APIs, Speech-to-Text Converters, Whisper-Based Engines, Speech to Text Transcription, Automated Video Subtitling, Timed Text Tracks.

¿Qué alternativas de código abierto existen para agermanidis/autosub?

Las alternativas de código abierto para agermanidis/autosub incluyen: linyqh/narratoai — NarratoAI is an automated video production pipeline that uses large language models to generate scripts, voiceovers,… tmoroney/auto-subs — Auto-subs is an AI transcription and automatic captioning tool that converts spoken audio from video files into… umlx5h/llplayer — LLPlayer is a language learning media player and AI subtitle generator that integrates large language models for… wxbool/video-srt-windows — This is a Windows application for automatic speech recognition that transcribes spoken audio from video files into… abus-aikorea/voice-pro — Voice Pro is a comprehensive speech and audio processing toolkit that combines text-to-speech synthesis, voice… weifeng2333/videocaptioner — VideoCaptioner is an automated tool designed to generate and embed time-synchronized subtitles into video files. By…