Fish Audio OpenAudio S2-Pro on vLLM-Omni. low-latency ~100ms TTFA, OpenAI-compatible, runs on NVIDIA Blackwell (RTX 5090 / RTX PRO 6000). Self-hosted streaming TTS & voice cloning.
text-to-speechstreamingreal-timecudaself-hostedttsspeech-synthesislow-latencyopenaudiovoice-cloningfastapiblackwellopenai-apivllmfish-speechrtx-5090rtx-pro-6000elevenlabs-alternative
-
Updated
Jun 27, 2026 - Python