API de audio

Live
Sintetiza voz o transcribe audio subido y alojado.
Abrir en ChatGPT
(opens in new tab)
Última verificación: 2026-08-11

Texto a voz

Envía hasta 600 caracteres. El endpoint en producción devuelve audio WAV; speed solo acepta 1 por ahora.
bash
curl https://api.modelrush.ai/v1/audio/speech \
-H "Authorization: Bearer $MODELRUSH_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"modelrush/qwen3-tts-flash","input":"ModelRush connected","voice":"Cherry"}' \
--output speech.wav

Voz a texto

Envía audio multipart o JSON con una referencia de audio pública admitida. La respuesta incluye el texto transcrito, el modelo, la región y los identificadores de petición.
bash
curl https://api.modelrush.ai/v1/audio/transcriptions \
-H "Authorization: Bearer $MODELRUSH_API_KEY" \
-F "model=modelrush/qwen3-asr-flash" \
-F "file=@meeting.wav"