ModelRushTexto

Qwen3.5 Omni Flash Realtime API

Qwen3.5 Omni Flash Realtime executa sessões em tempo real a partir de áudio e texto em streaming pela API do ModelRush e devolve uma sessão em streaming. As requisições rodam de forma síncrona e a resposta já traz o resultado. Pode ser chamado em 2 regiões de execução, a partir de $4.081 por 1M de tokens de entrada.
Omni-modal

Entrada

sync
Custo estimado$4.081
Entre para gerar

Prévia de saída

Esta é uma prévia das capacidades. Entre na conta para enviar uma solicitação real e conferir o resultado gerado.
token5s

Informações do modelo

Ideal para

Funcionalidades do produtoFluxos de trabalho automatizadosFerramentas de agentes

Preço atual para clientes

Cada linha identifica a Operation, a Region, a variante de preço e a versão de preço imutável usadas na execução.
ModeloCapacidadeRegião de execuçãoVariante de preçoPreço para o cliente
Qwen3.5 Omni Flash Realtime · modelrush/qwen3.5-omni-flash-realtimeTempo realcn-beijingPadrãoEntrada $4.081 · Saída $16.181 / 1M de tokens
Qwen3.5 Omni Flash Realtime · modelrush/qwen3.5-omni-flash-realtimeTempo realsg-singaporePadrãoEntrada $4.95 · Saída $19.47 / 1M de tokens

Outros modelos recomendados

LLM

DeepSeek V4 Flash 0731

Raciocínio e geração de texto com baixa latência e baixo custo
Preço inicial
$0.424/ 1M de tokens
LLM

DeepSeek V4 Pro

Modelo de raciocínio · lançado em 4 regiões
Preço inicialPreço a definir
LLM

GLM 5.1

Modelo de raciocínio · lançado em 5 regiões
Preço inicialPreço a definir
ModelRushUma integração, roteamento inteligente e cobrança transparente. Infraestrutura de modelos para times de desenvolvimento e agentes.
© 2026 ModelRushTodos os sistemas operacionais