Texto e chat

Live
Chat completions compatíveis com OpenAI para cargas de texto e raciocínio.
Abrir no ChatGPT
(opens in new tab)
Última verificação: 2026-08-11

Modelo de requisição

Envie um array messages ordenado e o ID de um modelo de texto em produção. temperature e max_tokens são suportados. Grok 4.5 e 4.6 também aceitam tools, tool_choice, parallel_tool_calls e response_format compatíveis com OpenAI. O Grok 4.5 suporta reasoning_effort com os valores low, medium ou high; o Grok 4.6 também suporta xhigh. Omita stream para uma resposta JSON, ou use stream: true para eventos server-sent compatíveis com OpenAI; stream_options.include_usage é aceito. Clientes de compatibilidade podem enviar store: false.
bash
curl https://api.modelrush.ai/v1/chat/completions \
-H "Authorization: Bearer $MODELRUSH_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "modelrush/grok-4.6",
"messages": [{"role": "user", "content": "Return exactly: ModelRush connected"}]
}'
bash
curl https://api.modelrush.ai/v1/chat/completions \
-H "Authorization: Bearer $MODELRUSH_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"modelrush/grok-4.6","messages":[{"role":"user","content":"Stream a short answer"}],"stream":true}'

Contrato de resposta

A resposta segue o formato de Chat Completions com id, model, choices e usage. Guarde o ID da resposta para suporte e conciliação.

Limites

O ModelRush não impõe um limite global de quantidade de mensagens e nunca trunca, mescla, apaga ou reordena o histórico da conversa silenciosamente. A capacidade é definida pela janela de contexto do modelo escolhido, pelo limite publicado de tamanho do corpo da requisição e por qualquer limite específico do provedor declarado para aquela operação de modelo. Leia os limites versionados em GET /models; não copie a janela de contexto nem o teto de saída de um modelo para outra integração. Corpos grandes demais devolvem request_too_large; o estouro de contexto devolve context_length_exceeded.