La mayoría de las interfaces de IA actuales son conversaciones con sistemas remotos. Útiles, pero incompletas. El cambio relevante ocurre cuando el viaje de ida y vuelta desaparece.
Presupuestos, no métricas
La latencia de extremo a extremo no es un único número. Es un presupuesto distribuido entre captura de señal, consulta de memoria, planificación, ejecución del modelo, verificaciones de política, acción y validación:
T_total = T_signal + T_context + T_model + T_policy + T_action + T_verify
El diseño parte del tiempo permitido entre señal y acción — todo lo demás se ingenia para encajar dentro de ese margen.
Lo que la velocidad habilita
- Copilotos en vivo que se actualizan mientras escribes, arrastras, calculas precios o trazas rutas
- Simulaciones continuas que evalúan posibilidades antes de comprometerse
- Contexto privado utilizado sin un salto de red en cada paso
Los sistemas rápidos pero incorrectos no son sistemas inteligentes — por eso los controles de corrección se publican junto con la velocidad.