speech

25 Projekte teilen dieses GitHub-Topic

speech — MockingBird ★36.9kspeechwhisperX — ★23.1kannyang — ★6.8kwhisper-diarization — ★5.6kstt — ★4.7kultravox — ★4.5kmetavoice-src — ★4.2kMARS5-TTS — ★2.8kIMS-Toucan — ★2.2kjulius — ★1.9kallosaurus — ★738vits2 — ★642Leaderboard — ★547UniSpeech — ★486huggingsound — ★470docker-whisperX — ★452Ming-UniAudio — ★450speech-recognition-uk — ★439WaveGrad — ★409Freeze-Omni — ★388wav2vec2-live — ★378gazelle — ★374MsEdgeTTS — ★335AudioBench — ★319end2end-asr-pytorch — ★304whisperX★ 23.1kannyang★ 6.8kwhisper-diarization★ 5.6kstt★ 4.7kultravox★ 4.5kmetavoice-src★ 4.2kMARS5-TTS★ 2.8kIMS-Toucan★ 2.2kjulius★ 1.9kallosaurus★ 738vits2★ 642Leaderboard★ 547UniSpeech★ 486huggingsound★ 470docker-whisperX★ 452Ming-UniAudio★ 450speech-recognition-uk★ 439WaveGrad★ 409Freeze-Omni★ 388wav2vec2-live★ 378gazelle★ 374MsEdgeTTS★ 335AudioBench★ 319end2end-asr-pytorch★ 304

Linien verbinden Mitglieder, die messbar miteinander verwandt sind. Die Punktgröße spiegelt die Sterne wider.

🧬 Mitglieder
MockingBird
🚀Clone a voice in 5 seconds to generate arbitrary speech in real-time
★ 36.9k
whisperX
WhisperX: Automatic Speech Recognition with Word-level Timestamps (& Diarization)
★ 23.1k
annyang
💬 Speech recognition for your site
★ 6.8k
whisper-diarization
Automatic Speech Recognition with Speaker Diarization based on OpenAI Whisper
★ 5.6k
stt
★ 4.7k
ultravox
A fast multimodal LLM for real-time voice
★ 4.5k
metavoice-src
Foundational model for human-like, expressive TTS
★ 4.2k
MARS5-TTS
MARS5 speech model (TTS) from CAMB.AI
★ 2.8k
IMS-Toucan
Controllable and fast Text-to-Speech for over 7000 languages!
★ 2.2k
julius
Open-Source Large Vocabulary Continuous Speech Recognition Engine
★ 1.9k
allosaurus
Allosaurus is a pretrained universal phone recognizer for more than 2000 languages
★ 738
vits2
VITS2: Improving Quality and Efficiency of Single-Stage Text-to-Speech with Adversarial Learning and…
★ 642
Leaderboard
SpeechIO Leaderboard: a large, robust, comprehensive, benchmarking platform for Automatic Speech Recognition.
★ 547
UniSpeech
UniSpeech - Large Scale Self-Supervised Learning for Speech
★ 486
huggingsound
HuggingSound: A toolkit for speech-related tasks based on Hugging Face's tools
★ 470
docker-whisperX
Dockerfile for WhisperX: Automatic Speech Recognition with Word-Level Timestamps and Speaker Diarization…
★ 452
Ming-UniAudio
Ming-UniAudio: Speech LLM for Joint Understanding, Generation and Editing with Unified Representation
★ 450
speech-recognition-uk
🇺🇦 Speech Recognition & Synthesis for Ukrainian
★ 439
WaveGrad
Implementation of WaveGrad high-fidelity vocoder from Google Brain in PyTorch.
★ 409
Freeze-Omni
✨✨Freeze-Omni: A Smart and Low Latency Speech-to-speech Dialogue Model with Frozen LLM
★ 388
wav2vec2-live
A live speech recognition using Facebooks wav2vec 2.0 model.
★ 378
gazelle
Joint speech-language model - respond directly to audio!
★ 374
MsEdgeTTS
A simple Azure Speech Service module that uses the Microsoft Edge Read Aloud API.…
★ 335
AudioBench
AudioBench: A Universal Benchmark for Audio Large Language Models
★ 319
end2end-asr-pytorch
End-to-End Automatic Speech Recognition on PyTorch
★ 304
🔗 Verwandte Familien

Gemessen anhand der von beiden Projekten geteilten GitHub-Themen, gewichtet nach der Seltenheit jedes Themas.