ElevenLabs local no seu próprio hardware com o VoiceStudio
VoiceStudio traz síntese de voz, clonagem e transcrição com qualidade de ElevenLabs para o seu próprio hardware—sem nuvem, sem assinaturas, apenas poder open-source.
Idioma
InícioLinguagens
Seções
VoiceStudio traz síntese de voz, clonagem e transcrição com qualidade de ElevenLabs para o seu próprio hardware—sem nuvem, sem assinaturas, apenas poder open-source.
SGLang-Omni provides a specialized runtime for multi-stage inference of voice and multimodal models, handling the complex pipeline from audio encoding to speech synthesis.
A look at Uncensored Local Studio, a unified desktop client that combines Stable Diffusion, language models, speech recognition, and text-to-speech into a single app.
Alexandria transforma qualquer texto em uma produção de áudio com múltiplas vozes usando análise por LLM e síntese neural de fala. Veja como funciona e se vale a pena experimentar.
MLX-Audio brings lightning-fast TTS, STT, and STS capabilities to Apple Silicon Macs. Built on Apple's MLX framework, it offers Whisper, Kokoro, voice cloning, and more—all running locally without cloud costs.
IndexTTS2 é um modelo open-source de síntese de fala com controle de duração e separação de emoções para vozes realistas.
GPT-SoVITS é uma solução open-source de clonagem de voz que pode sintetizar fala com apenas 5 segundos de áudio. Conheça seus recursos e aplicações práticas.