LLMs en LATAM: infraestructura, latencia y costos reales

Benchmark de latencia y costo por token para despliegues en México y Colombia. Datos de campo, no marketing.

Corrimos benchmarks durante 30 días con cargas reales de clientes en CDMX y Bogotá. La latencia a APIs de US-East es aceptable para async; para sync en tiempo real, necesitas edge o cache agresivo.

El costo por 1M tokens varía hasta 3x según proveedor y horario. Documentamos los números reales para ayudar a dimensionar presupuestos.