Hola a todos, estoy diseñando un sistema de procesamiento de colas con AWS Lambda y SQS, pero tengo dudas sobre la lógica de autoescalado. Mi setup:
- SQS estándar con un batch de 10 mensajes.
- Lambda con un máximo de 1000 concurrencias reservadas.
- Procesa mensajes que pueden tardar entre 1 y 30 segundos.
El problema: cuando la cola crece, Lambda escala rápidamente, pero a veces se dispara demasiado y luego baja de golpe, dejando mensajes sin procesar. Mi lógica actual es: si la cola tiene más de 1000 mensajes, aumento la concurrencia de Lambda en 100 cada minuto. Si baja de 100, reduzco en 50. ¿Ven algún problema? Acepto sugerencias de arquitectura o correcciones.