Model Recipes
Fish Audio

fishaudio/s2-pro

Fish Audio's dual-AR text-to-speech model served via vLLM-Omni, producing 44.1 kHz mono audio with optional voice cloning, through the OpenAI /v1/audio/speech API.

Guide