awesome-repositories.com
Blog
MCP
awesome-repositories.com

Découvrez les meilleurs dépôts open-source grâce à notre recherche par IA.

ExplorerRecherches sélectionnéesAlternatives open sourceLogiciels auto-hébergésBlogPlan du site
ProjetServeur MCPÀ proposNotre méthodologiePresse
Mentions légalesConfidentialitéConditions d'utilisation
© 2026 Bringes Technology SRL·VAT RO45896025·hello@awesome-repositories.com
·

5 dépôts

Awesome GitHub RepositoriesAudio Codec Decoders

Software implementations that translate compressed audio bitstreams back into raw waveforms.

Distinct from Audio Format Decoders: Candidates focus on resampling or specific sample extraction, not the core decoding process of a codec.

Explore 5 awesome GitHub repositories matching graphics & multimedia · Audio Codec Decoders. Refine with filters or upvote what's useful.

Awesome Audio Codec Decoders GitHub Repositories

Trouvez les meilleurs dépôts grâce à l'IA.Nous recherchons les dépôts les plus pertinents grâce à l'IA.
  • uberi/speech_recognitionAvatar de Uberi

    Uberi/speech_recognition

    8,973Voir sur GitHub↗

    This project is a Python speech recognition library that serves as a unified interface for converting spoken audio into text. It functions as a bridge between Python applications and a variety of speech-to-text engines, providing a consistent way to interact with both local and cloud-based recognition services. The library distinguishes itself as a multi-engine transcription tool, wrapping diverse online APIs and offline recognition backends into a standardized format. This allows for interchangeable recognition engines and supports multilingual audio transcription through various language pa

    Translates various audio file containers like WAV and FLAC into raw waveforms for transcription processing.

    Pythonaudiopythonspeech-recognition
    Voir sur GitHub↗8,973
  • nevcairiel/lavfiltersAvatar de Nevcairiel

    Nevcairiel/LAVFilters

    8,969Voir sur GitHub↗

    LAVFilters is an open-source media filter pack consisting of splitters and decoders designed for the DirectShow framework. It functions as a set of software components that convert compressed media data into raw formats for hardware or software rendering. The collection includes a media splitter to separate combined audio and video container formats into individual streams, as well as a specialized Blu-ray disc player filter used to identify and extract movie titles and playlists from disc structures. The project provides capabilities for audio and video stream decoding, media stream demuxin

    Translates compressed audio bitstreams back into raw waveforms compatible with system hardware.

    C++
    Voir sur GitHub↗8,969
  • xiph/opusAvatar de xiph

    xiph/opus

    3,035Voir sur GitHub↗

    Opus is a lossy audio compression standard and codec designed for high-quality speech and music transmission over the internet. It functions as a low-latency audio codec and network-resilient streamer, providing a framework for encoding and decoding digital audio. The project distinguishes itself through the support of multi-channel ambisonics for immersive three-dimensional spatial audio reproduction. It is specifically optimized for real-time interactive communication, utilizing dynamic bitrate adjustment and forward error correction to maintain audio quality on unstable networks. The syst

    Translates compressed bitstreams back into raw audio for playback or further processing.

    Caudioccodec
    Voir sur GitHub↗3,035
  • musicplayerdaemon/mpdAvatar de MusicPlayerDaemon

    MusicPlayerDaemon/MPD

    2,607Voir sur GitHub↗

    MPD is a headless music server daemon that indexes audio libraries and streams music to local or remote outputs. It functions as a music library manager and network audio streamer, providing a remote audio control protocol that allows external clients to manage playback, playlists, and database queries. The system acts as a multiroom audio coordinator, synchronizing audio distribution across multiple networked clients and hardware devices. It supports a variety of remote management capabilities, including a dedicated control API and the ability to broadcast audio streams over network protocol

    Parses various compressed and lossless audio formats into raw waveforms for playback.

    C++audioaudio-playermusic
    Voir sur GitHub↗2,607
  • soniqo/speech-swiftAvatar de soniqo

    soniqo/speech-swift

    896Voir sur GitHub↗

    Ce projet est une boîte à outils complète pour la reconnaissance vocale, la synthèse et le traitement audio sur l'appareil, spécifiquement conçue pour Apple Silicon. Il fournit un framework pour construire des agents vocaux en temps réel et full-duplex qui fonctionnent entièrement hors ligne, tirant parti de l'accélération matérielle native pour maintenir les performances et la confidentialité. En utilisant des modèles de machine learning optimisés, la bibliothèque permet l'exécution locale de tâches audio complexes sans dépendance à des services cloud externes. La bibliothèque se distingue par son accent spécialisé sur l'interaction vocale locale haute performance. Elle inclut une orchestration sophistiquée pour les pipelines audio en streaming, permettant la transcription en temps réel, la synthèse vocale et le clonage de voix avec une faible latence. Le système est conçu pour gérer des conversations interactives continues, avec des mécanismes intégrés pour éviter les boucles de rétroaction audio et gérer les sessions de streaming persistantes. Au-delà de l'interaction de base, le projet offre une large suite de capacités d'amélioration et de gestion audio. Il prend en charge le traitement avancé du signal, y compris la séparation des sources, la réduction du bruit et le suréchantillonnage audio, parallèlement à des outils pour la diarisation des locuteurs et l'extraction d'embeddings. Le framework fournit également des utilitaires étendus de gestion de modèles, tels que des contrôles de quantification, la gestion de la mémoire et la prise en charge du chargement de poids de modèles personnalisés, garantissant que les développeurs peuvent équilibrer la vitesse de traitement et la consommation de ressources sur le matériel local. Le projet inclut une interface en ligne de commande pour exécuter des tâches audio et convertir les poids des modèles en formats optimisés. Il expose également des points de terminaison HTTP et WebSocket pour faciliter l'intégration avec les interfaces industrielles standard.

    Translates compressed audio bitstreams back into raw waveforms.

    Swiftapple-siliconasrcoreml
    Voir sur GitHub↗896
  1. Home
  2. Graphics & Multimedia
  3. Audio Codec Decoders