Lokalny ElevenLabs na własnym sprzęcie z VoiceStudio
VoiceStudio oferuje lokalną syntezę głosu, klonowanie i transkrypcję jakości ElevenLabs na własnym sprzęcie—bez chmury, bez subskrypcji, tylko open-source.
Język
Strona głównaJęzyki
Sekcje
VoiceStudio oferuje lokalną syntezę głosu, klonowanie i transkrypcję jakości ElevenLabs na własnym sprzęcie—bez chmury, bez subskrypcji, tylko open-source.
SGLang-Omni udostępnia wyspecjalizowane środowisko uruchomieniowe do wielostopniowej inferencji modeli głosowych i multimodalnych, obsługując złożony potok przetwarzania od kodowania audio po syntezę mowy.
Pixelle-Video to silnik automatyzujący tworzenie krótkich filmów z jednego monitu tekstowego. Generuje pliki MP4 z lektorem, napisami, muzyką i obrazami AI.
Alexandria przekształca dowolny tekst w produkcję audio z wieloma głosami, wykorzystując analizę LLM i neuronową syntezę mowy. Oto jak to działa i czy warto spróbować.
UnrealGenAISupport to wtyczka open-source łącząca Unreal Engine z nowoczesnymi LLM-ami, takimi jak OpenAI, Claude, DeepSeek i Gemini, oferująca wsparcie MCP do sterowania edytorem.
IndexTTS2 to next-generation model syntezy mowy open-source z precyzyjną kontrolą czasu trwania i separacją emocji do realistycznej generacji głosu.
GPT-SoVITS to open-source'owe rozwiązanie do klonowania głosu, które potrafi syntetyzować mowę z zaledwie 5 sekund nagrania. Poznaj jego funkcje i praktyczne zastosowania.