Ir al contenido

Referencia de API

Rate limits

Para proteger la plataforma, la API aplica límites de frecuencia (rate limiting) por tipo de endpoint. Al superarlos recibes un 429 Too Many Requests.

  • Los límites se aplican por ventana de tiempo (por ejemplo, X peticiones por minuto).
  • Los endpoints sensibles (autenticación, facturación) tienen límites más estrictos que los de lectura.
EndpointLímite
Crear/editar/duplicar asistentes30 por hora, por workspace
Chat de prueba y generación de prompt con IA20 por minuto, por usuario
Enviar mensaje / plantilla / adjunto en conversaciones60 por minuto, por usuario
Crear/subir/reintentar documentos de conocimiento20 por minuto, por usuario
Chat público del widget (POST /widget/chat)30 por minuto, por widgetToken
Resto de endpoints públicos del widget (config, appearance, history, close)60 por minuto, por widgetToken

Estos son los límites vigentes hoy; pueden ajustarse sin previo aviso — trata siempre el 429 como una condición esperada, no como un error a ignorar.

Cuando recibas un 429:

  1. Espera antes de reintentar.
  2. Usa backoff exponencial (aumenta el tiempo de espera en cada reintento).
  3. Evita ráfagas: distribuye las peticiones en el tiempo.
  • Cachea las respuestas que no cambian a menudo en lugar de pedirlas repetidamente.
  • Para operaciones masivas, usa los endpoints bulk cuando existan, en vez de muchas peticiones individuales.
  • Para reaccionar a eventos, prefiere webhooks / flujos antes que hacer polling constante.