Dimos por sentado que un servicio se comportaba igual que uno parecido de otro proveedor. Ese supuesto nos costó un fin de semana entero de trabajo extra.
Veníamos de trabajar con un proveedor durante años y conocíamos bien sus límites. Al migrar a uno nuevo, asumimos que un servicio equivalente se comportaba igual. Craso error.
El límite de tamaño por request en el proveedor nuevo era bastante menor al que estábamos acostumbrados. Como nunca lo confirmamos por escrito, seguimos enviando lotes del mismo tamaño de siempre.
Un viernes por la tarde empezaron a fallar cargas silenciosamente: no había error visible en el dashboard principal, solo registros que nunca llegaban a destino. Nos tomó gran parte del sábado encontrar el patrón.
Bajamos el tamaño de los lotes y agregamos reintentos con backoff. Técnicamente simple. Lo caro fue el tiempo perdido en diagnosticar algo que la documentación del proveedor nuevo mencionaba en la segunda página, que nadie del equipo había leído completa.
"Se parece a lo que ya conocemos" es la frase más peligrosa al migrar de proveedor. Hay que leer la documentación nueva como si no supiéramos nada.