Skip to main content
No hay endpoint síncrono. Consultar un motor de IA tarda de segundos a minutos, así que cada solicitud se convierte en una tarea en cola, persistente, que recoges después.

Ciclo de vida

Estados

status
Aceptada y persistida. Esperando a un worker.
status
Un worker tiene un lease sobre la tarea y está operando el motor.
status
Estado final. El campo response está rellenado.
status
Estado final. El campo error indica el motivo.
Una tarea que sufre un fallo transitorio (timeout del motor, error transitorio) vuelve a QUEUED y se reintenta. Solo cuando se agotan los reintentos queda en FAILED, así que las transiciones PROCESSING → QUEUED son normales y no deben disparar alertas.

Prioridad

priority se conserva por compatibilidad y se devuelve en los metadatos de la tarea. Acepta de 1 a 10, por defecto 1, y los valores fuera de rango se ajustan al rango en lugar de rechazarse.
El orden de ejecución no está garantizado por prioridad, hora de envío ni cuenta. Para trabajo dependiente, espera a que la tarea anterior termine antes de enviar la siguiente. Los límites de concurrencia del plan se aplican a las tareas en cola y en proceso.

Retención

Las tareas finalizadas están disponibles por sondeo público durante 24 horas tras completarse. Después, GET /v1/async/task/{id} devuelve 404 NOT_FOUND, la misma respuesta que un id que nunca existió. El registro subyacente se conserva de forma permanente; la caducidad limita el sondeo público y la reproducción manual de webhooks, no el almacenamiento. Los reintentos automáticos de webhook continúan de forma independiente. Si dependes del sondeo en lugar de webhooks, recoge los resultados con margen dentro de ese plazo.

Webhook o sondeo

Prefiere los webhooks. El sondeo es la vía de recuperación. Un cliente robusto usa ambos: toma el webhook como vía rápida y concilia por sondeo lo que no te haya llegado antes de que se cierre la ventana de retención.