Referencia de API
Rate limits
Para proteger la plataforma, la API aplica límites de frecuencia (rate limiting) por tipo de endpoint. Al superarlos recibes un 429 Too Many Requests.
Cómo funciona
Sección titulada «Cómo funciona»- Los límites se aplican por ventana de tiempo (por ejemplo, X peticiones por minuto).
- Los endpoints sensibles (autenticación, facturación) tienen límites más estrictos que los de lectura.
Algunos límites de escritura
Sección titulada «Algunos límites de escritura»| Endpoint | Límite |
|---|---|
| Crear/editar/duplicar asistentes | 30 por hora, por workspace |
| Chat de prueba y generación de prompt con IA | 20 por minuto, por usuario |
| Enviar mensaje / plantilla / adjunto en conversaciones | 60 por minuto, por usuario |
| Crear/subir/reintentar documentos de conocimiento | 20 por minuto, por usuario |
Chat público del widget (POST /widget/chat) | 30 por minuto, por widgetToken |
Resto de endpoints públicos del widget (config, appearance, history, close) | 60 por minuto, por widgetToken |
Estos son los límites vigentes hoy; pueden ajustarse sin previo aviso — trata siempre el 429 como una condición esperada, no como un error a ignorar.
Manejar un 429
Sección titulada «Manejar un 429»Cuando recibas un 429:
- Espera antes de reintentar.
- Usa backoff exponencial (aumenta el tiempo de espera en cada reintento).
- Evita ráfagas: distribuye las peticiones en el tiempo.
Buenas prácticas
Sección titulada «Buenas prácticas»- Cachea las respuestas que no cambian a menudo en lugar de pedirlas repetidamente.
- Para operaciones masivas, usa los endpoints bulk cuando existan, en vez de muchas peticiones individuales.
- Para reaccionar a eventos, prefiere webhooks / flujos antes que hacer polling constante.