Latenza

term_id: latency

Category: engineering_practice

Definition

La latenza misura la reattività di un servizio di IA, espressa tipicamente in millisecondi. Include il tempo di inferenza, i ritardi nella trasmissione di rete e l’overhead di elaborazione. Una bassa latenza è critica per le applicazioni in tempo reale dove l’interazione immediata con l’utente o l’ambiente è essenziale per l’usabilità e la sicurezza.

Summary

Il ritardo temporale tra l’iniziazione di una richiesta e l’avvio della risposta in un sistema di intelligenza artificiale.

Key Concepts

  • Tempo di Inferenza
  • Tempo di Risposta
  • Elaborazione in Tempo Reale
  • Ottimizzazione

Use Cases

  • Sistemi di riconoscimento vocale
  • Controllo di veicoli autonomi
  • Servizi di traduzione live