Tiden det tar fra du ber om noe til svaret begynner å komme. Det er forsinkelsen du kjenner på en dårlig telefonlinje, der den andre svarer, men du hører det et lite øyeblikk for sent. Lav latency betyr at en KI-tjeneste svarer nesten med en gang. Høy latency betyr at du må vente.
En AI-resepsjonist som svarer i telefonen må ha lav latency. Bruker den to sekunder på hvert svar, blir samtalen tung for kunden som ringer.