Trabajos por lotes fiables

Live
Controla la concurrencia, los reintentos, la conciliación y el coste en muchas peticiones.
Abrir en ChatGPT
(opens in new tab)
Última verificación: 2026-08-11

Encola el trabajo

Crea un registro duradero por cada entrada, con un ID interno de trabajo, el ID de modelo, el hash del payload, el estado, el número de intentos y el ID de petición de ModelRush. Los workers deben tomar trabajos con una concurrencia acotada.

Clasifica los reintentos

Reintenta las respuestas 429 y los 5xx transitorios con jitter. Mueve los fallos de validación y de facturación a un estado de revisión. Para medios asíncronos, concilia el ID de generación existente antes de crear uno de reemplazo.

Mide la salida aprovechable

Sigue el total de intentos, las salidas correctas, las salidas aceptadas, la latencia y el gasto. El coste por salida aprovechable es más informativo que el precio por petición.