Lokalny ElevenLabs na własnym sprzęcie z VoiceStudio
VoiceStudio oferuje lokalną syntezę głosu, klonowanie i transkrypcję jakości ElevenLabs na własnym sprzęcie—bez chmury, bez subskrypcji, tylko open-source.
Język
Strona głównaJęzyki
Sekcje
VoiceStudio oferuje lokalną syntezę głosu, klonowanie i transkrypcję jakości ElevenLabs na własnym sprzęcie—bez chmury, bez subskrypcji, tylko open-source.
SGLang-Omni udostępnia wyspecjalizowane środowisko uruchomieniowe do wielostopniowej inferencji modeli głosowych i multimodalnych, obsługując złożony potok przetwarzania od kodowania audio po syntezę mowy.
A look at Uncensored Local Studio, a unified desktop client that combines Stable Diffusion, language models, speech recognition, and text-to-speech into a single app.
Alexandria przekształca dowolny tekst w produkcję audio z wieloma głosami, wykorzystując analizę LLM i neuronową syntezę mowy. Oto jak to działa i czy warto spróbować.
MLX-Audio oferuje błyskawiczne TTS, STT i STS na Mac z Apple Silicon. W oparciu o MLX, zapewnia Whisper, Kokoro, klonowanie głosu i więcej—lokalnie, bez chmury.
IndexTTS2 to next-generation model syntezy mowy open-source z precyzyjną kontrolą czasu trwania i separacją emocji do realistycznej generacji głosu.
GPT-SoVITS to open-source'owe rozwiązanie do klonowania głosu, które potrafi syntetyzować mowę z zaledwie 5 sekund nagrania. Poznaj jego funkcje i praktyczne zastosowania.