Latenza
term_id: latency
Category: engineering_practice
Definition
La latenza misura la reattività di un servizio di IA, espressa tipicamente in millisecondi. Include il tempo di inferenza, i ritardi nella trasmissione di rete e l’overhead di elaborazione. Una bassa latenza è critica per le applicazioni in tempo reale dove l’interazione immediata con l’utente o l’ambiente è essenziale per l’usabilità e la sicurezza.
Summary
Il ritardo temporale tra l’iniziazione di una richiesta e l’avvio della risposta in un sistema di intelligenza artificiale.
Key Concepts
- Tempo di Inferenza
- Tempo di Risposta
- Elaborazione in Tempo Reale
- Ottimizzazione
Use Cases
- Sistemi di riconoscimento vocale
- Controllo di veicoli autonomi
- Servizi di traduzione live