Texto y chat

Live
Chat completions compatibles con OpenAI para cargas de texto y razonamiento.
Abrir en ChatGPT
(opens in new tab)
Última verificación: 2026-08-11

Modelo de petición

Envía un array messages ordenado y el ID de un modelo de texto en producción. Se admiten temperature y max_tokens. Grok 4.5 y 4.6 aceptan además tools, tool_choice, parallel_tool_calls y response_format compatibles con OpenAI. Grok 4.5 admite reasoning_effort con los valores low, medium o high; Grok 4.6 admite también xhigh. Omite stream para obtener una respuesta JSON, o usa stream: true para eventos server-sent compatibles con OpenAI; se acepta stream_options.include_usage. Los clientes de compatibilidad pueden enviar store: false.
bash
curl https://api.modelrush.ai/v1/chat/completions \
-H "Authorization: Bearer $MODELRUSH_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "modelrush/grok-4.6",
"messages": [{"role": "user", "content": "Return exactly: ModelRush connected"}]
}'
bash
curl https://api.modelrush.ai/v1/chat/completions \
-H "Authorization: Bearer $MODELRUSH_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"modelrush/grok-4.6","messages":[{"role":"user","content":"Stream a short answer"}],"stream":true}'

Contrato de respuesta

La respuesta sigue la forma de Chat Completions con id, model, choices y usage. Guarda el ID de la respuesta para soporte y conciliación.

Límites

ModelRush no impone un límite global de número de mensajes y nunca trunca, fusiona, elimina ni reordena el historial de conversación en silencio. La capacidad la determinan la ventana de contexto del modelo elegido, el límite publicado de tamaño del cuerpo de la petición y cualquier límite específico del proveedor declarado para esa operación de modelo. Lee los límites versionados en GET /models; no copies la ventana de contexto ni el tope de salida de un modelo a otra integración. Los cuerpos demasiado grandes devuelven request_too_large; el desbordamiento de contexto devuelve context_length_exceeded.