awesome-repositories.com
Blog
MCP
awesome-repositories.com

Entdecke die besten Open-Source-Repositories mit KI-gestützter Suche.

EntdeckenKuratierte SuchenOpen-Source-AlternativenSelf-hosted SoftwareBlogSitemap
ProjektMCP-ServerÜber unsRanking-MethodikPresse
RechtlichesDatenschutzAGB
© 2026 Bringes Technology SRL·VAT RO45896025·hello@awesome-repositories.com
·

6 Repos

Awesome GitHub RepositoriesAudio Encoding

Converting raw audio streams into compressed or specific digital formats for output.

Distinct from Audio Output Configurations: Distinct from Output Configurations: focuses on the data conversion process rather than hardware settings.

Explore 6 awesome GitHub repositories matching graphics & multimedia · Audio Encoding. Refine with filters or upvote what's useful.

Awesome Audio Encoding GitHub Repositories

Finde die besten Repos mit KI.Wir suchen mit KI nach den am besten passenden Repositories.
  • arthenica/ffmpeg-kitAvatar von arthenica

    arthenica/ffmpeg-kit

    5,836Auf GitHub ansehen↗

    ffmpeg-kit is a cross-platform SDK that wraps FFmpeg and FFprobe into native libraries for Android, iOS, macOS, Linux, and tvOS, enabling applications to execute media processing commands through platform-specific APIs. It provides a concurrent command executor that runs multiple FFmpeg operations simultaneously and collects results independently via thread-safe interfaces. The project includes a build system that compiles FFmpeg native libraries from source with configurable codec and library options for each target platform, and offers eight precompiled binary packages with different sets o

    Transcodes audio files into various formats and codecs using FFmpeg commands.

    Candroidffmpegflutter
    Auf GitHub ansehen↗5,836
  • xiangyuecn/recorderAvatar von xiangyuecn

    xiangyuecn/Recorder

    5,615Auf GitHub ansehen↗

    Recorder ist eine JavaScript-Bibliothek zur Aufnahme von Audio über Mikrofone und zur Kodierung der resultierenden Daten in mehrere Formate, einschließlich MP3, WAV und WebM. Sie bietet eine einheitliche Schnittstelle für plattformübergreifende Audioaufnahmen über Webbrowser und mobile Anwendungen hinweg. Die Bibliothek fungiert als Tool zur Audiosignalverarbeitung und Wellenform-Visualisierung und bietet visuelles Echtzeit-Feedback durch Frequenz-Histogramme und Wellenformen. Sie enthält spezialisierte Funktionen für die Kodierung und Dekodierung von DTMF-Tönen (Dual-Tone Multi-Frequency) von Telefon-Tastenfeldern. Das Projekt deckt ein breites Spektrum an Audio-Manipulationsfunktionen ab, einschließlich Signalverarbeitung für Tonhöhen- und Geschwindigkeitsänderungen, Rauschunterdrückung und Echokompensation. Es unterstützt Audio-Streaming in Echtzeit für Sprachkommunikation, das Zusammenführen von Audiodateien, das Zuschneiden von Segmenten sowie die Integration mit automatischen Spracherkennungsdiensten für die Umwandlung von Sprache in Text.

    Converts raw PCM audio data into compressed formats like MP3 and WAV using JavaScript-based encoders.

    JavaScriptamrasraudio
    Auf GitHub ansehen↗5,615
  • philippe44/airconnectAvatar von philippe44

    philippe44/AirConnect

    4,104Auf GitHub ansehen↗

    AirConnect ist ein Cross-Protocol-Audio-Gateway und Netzwerk-Proxy, der AirPlay-Audio-Streams an Nicht-Apple-Hardware weiterleitet, wie z. B. Chromecast, Sonos und andere UPnP-kompatible Mediaplayer. Es fungiert als Multi-Plattform-Audio-Streamer, der das Casting von Audio von Apple-Geräten auf eine Vielzahl von Smart-Speakern und Netzwerk-Audiogeräten über ein lokales Netzwerk ermöglicht. Das Projekt nutzt virtuelle AirPlay-Geräteemulation, um die Netzwerkidentität eines Empfängers nachzuahmen, wodurch Apple-Geräte den Proxy als gültiges Streaming-Ziel erkennen. Es übersetzt AirPlay-Signale und führt On-the-Fly-Audio-Transcoding und Re-Encoding durch, um den spezifischen Codec-Anforderungen verschiedener Hardware-Player zu entsprechen. Das System verwaltet Cross-Protocol-Media-Routing durch Proxy-basiertes Audio-Routing und UPnP-basierte Geräteerkennung. Es enthält Mechanismen zur Synchronisierung der Wiedergabesteuerung, um Lautstärkeänderungen und Befehle weiterzuleiten, sowie Puffer-Management, um Wiedergabelatenzen zu handhaben und Netzwerk-Stream-Stottern zu verhindern.

    Transforms decoded audio into multiple formats to ensure compatibility with diverse target hardware players.

    Cairplaybridgechromecast
    Auf GitHub ansehen↗4,104
  • musicplayerdaemon/mpdAvatar von MusicPlayerDaemon

    MusicPlayerDaemon/MPD

    2,607Auf GitHub ansehen↗

    MPD is a headless music server daemon that indexes audio libraries and streams music to local or remote outputs. It functions as a music library manager and network audio streamer, providing a remote audio control protocol that allows external clients to manage playback, playlists, and database queries. The system acts as a multiroom audio coordinator, synchronizing audio distribution across multiple networked clients and hardware devices. It supports a variety of remote management capabilities, including a dedicated control API and the ability to broadcast audio streams over network protocol

    Converts raw audio streams into specific compressed digital formats for output distribution.

    C++audioaudio-playermusic
    Auf GitHub ansehen↗2,607
  • slhck/ffmpeg-normalizeAvatar von slhck

    slhck/ffmpeg-normalize

    1,509Auf GitHub ansehen↗

    Dieses Dienstprogramm ist ein Befehlszeilen-Tool, das darauf ausgelegt ist, die Lautstärkeanpassung über Audio- und Videosammlungen hinweg zu automatisieren. Durch die Nutzung externer Medienverarbeitungsbibliotheken passt es Dateien auf einen konsistenten Ziellautstärkepegel an und stellt eine einheitliche Wiedergabe ohne manuelle Lautstärkeanpassungen sicher. Das Tool zeichnet sich durch einen Zwei-Pass-Analyse-Workflow aus, der Lautstärkestatistiken misst, bevor präzise Verstärkungsanpassungen angewendet werden. Es behält die relativen Lautstärkebeziehungen zwischen Titeln bei der Verarbeitung von Sammlungen bei und stellt sicher, dass die dynamische Balance einer Gruppe von Dateien intakt bleibt. Benutzer können benutzerdefinierte Konfigurations-Presets definieren und speichern, um diese Normalisierungsparameter über verschiedene Medientypen und Umgebungen hinweg zu standardisieren. Die Software unterstützt umfassende Batch-Verarbeitung, was die automatisierte Normalisierung ganzer Verzeichnisse ermöglicht, während ursprüngliche Metadaten und Dateiintegrität erhalten bleiben. Sie enthält Logik zur Evaluierung von Dateien gegen Zielschwellenwerte und überspringt redundante Neukodierungen, um Rechenressourcen zu optimieren. Zudem bietet das Tool dynamisches Stream-Mapping, um spezifische Audiospuren innerhalb von Videocontainern zu isolieren, was eine Normalisierung ohne Veränderung des ursprünglichen Videoinhalts ermöglicht. Das Dienstprogramm wird als Befehlszeilenschnittstelle vertrieben und enthält Shell-Autovervollständigungsunterstützung für terminalbasierte Operationen. Es bietet zudem eine programmatische Schnittstelle für die Integration in benutzerdefinierte Anwendungen und automatisierte Medienverarbeitungs-Pipelines.

    Allows users to select appropriate audio codecs and apply custom presets to control the final quality of processed media files.

    HTMLaudioffmpegpython
    Auf GitHub ansehen↗1,509
  • soniqo/speech-swiftAvatar von soniqo

    soniqo/speech-swift

    896Auf GitHub ansehen↗

    Dieses Projekt ist ein umfassendes Toolkit für On-Device-Spracherkennung, -Synthese und Audioverarbeitung, das speziell für Apple Silicon entwickelt wurde. Es bietet ein Framework für den Aufbau von Echtzeit-Voice-Agents mit Vollduplex-Funktionalität, die vollständig offline arbeiten und native Hardwarebeschleunigung nutzen, um Performance und Datenschutz zu wahren. Durch den Einsatz optimierter Machine-Learning-Modelle ermöglicht die Bibliothek die lokale Ausführung komplexer Audioaufgaben ohne Abhängigkeit von externen Cloud-Diensten. Die Bibliothek zeichnet sich durch ihren spezialisierten Fokus auf lokale, hochperformante Sprachinteraktion aus. Sie enthält eine ausgefeilte Orchestrierung für Streaming-Audio-Pipelines, die Echtzeit-Transkription, Sprachsynthese und Voice-Cloning mit geringer Latenz ermöglicht. Das System ist für die Handhabung kontinuierlicher, interaktiver Konversationen konzipiert und verfügt über integrierte Mechanismen zur Vermeidung von Audio-Feedback-Schleifen und zur Verwaltung persistenter Streaming-Sitzungen. Über die Kerninteraktion hinaus bietet das Projekt eine breite Palette an Audio-Enhancement- und Management-Funktionen. Es unterstützt fortgeschrittene Signalverarbeitung, einschließlich Quellentrennung, Rauschunterdrückung und Audio-Upsampling, neben Tools für Sprecher-Diarisierung und Embedding-Extraktion. Das Framework bietet zudem umfangreiche Modellmanagement-Utilities, wie z. B. Quantisierungskontrollen, Speicherverwaltung und Unterstützung für das Laden benutzerdefinierter Modellgewichte, um sicherzustellen, dass Entwickler Verarbeitungsgeschwindigkeit und Ressourcenverbrauch auf lokaler Hardware ausbalancieren können. Das Projekt enthält eine CLI für die Ausführung von Audioaufgaben und die Konvertierung von Modellgewichten in optimierte Formate. Es stellt zudem HTTP- und WebSocket-Endpunkte bereit, um die Integration mit Standard-Industrieschnittstellen zu erleichtern.

    Encodes raw audio into structured codebook representations by resampling, padding, and applying causal vector quantization.

    Swiftapple-siliconasrcoreml
    Auf GitHub ansehen↗896
  1. Home
  2. Graphics & Multimedia
  3. Audio Output Configurations
  4. Audio Encoding

Unter-Tags erkunden

  • Codebook ConvertersEncodes audio into structured codebook representations. **Distinct from Audio Encoding:** Distinct from Audio Encoding: focuses on vector quantization and codebook mapping rather than general compression.