Texto y chat
Live
Abrir en ChatGPT
(opens in new tab)Última verificación: 2026-08-11Modelo de petición
Envía un array
messages ordenado y el ID de un modelo de texto en producción. Se admiten temperature y max_tokens. Grok 4.5 y 4.6 aceptan además tools, tool_choice, parallel_tool_calls y response_format compatibles con OpenAI. Grok 4.5 admite reasoning_effort con los valores low, medium o high; Grok 4.6 admite también xhigh. Omite stream para obtener una respuesta JSON, o usa stream: true para eventos server-sent compatibles con OpenAI; se acepta stream_options.include_usage. Los clientes de compatibilidad pueden enviar store: false.bashcurl https://api.modelrush.ai/v1/chat/completions \-H "Authorization: Bearer $MODELRUSH_API_KEY" \-H "Content-Type: application/json" \-d '{"model": "modelrush/grok-4.6","messages": [{"role": "user", "content": "Return exactly: ModelRush connected"}]}'
bashcurl https://api.modelrush.ai/v1/chat/completions \-H "Authorization: Bearer $MODELRUSH_API_KEY" \-H "Content-Type: application/json" \-d '{"model":"modelrush/grok-4.6","messages":[{"role":"user","content":"Stream a short answer"}],"stream":true}'
Contrato de respuesta
La respuesta sigue la forma de Chat Completions con
id, model, choices y usage. Guarda el ID de la respuesta para soporte y conciliación.Límites
ModelRush no impone un límite global de número de mensajes y nunca trunca, fusiona, elimina ni reordena el historial de conversación en silencio. La capacidad la determinan la ventana de contexto del modelo elegido, el límite publicado de tamaño del cuerpo de la petición y cualquier límite específico del proveedor declarado para esa operación de modelo. Lee los límites versionados en
GET /models; no copies la ventana de contexto ni el tope de salida de un modelo a otra integración. Los cuerpos demasiado grandes devuelven request_too_large; el desbordamiento de contexto devuelve context_length_exceeded.AnteriorResumen de las API de modelo
SiguienteGeneración de imágenes