Inferenza al bordo
term_id: edge_inference
Category: engineering_practice
Definition
Questa pratica prevede il deployment di modelli AI addestrati direttamente su hardware come smartphone, sensori IoT o sistemi embedded. Elaborando i dati localmente, l’inferenza al bordo riduce significativamente la latenza.
Summary
L’inferenza al bordo è il processo di esecuzione di modelli di apprendimento automatico localmente sui dispositivi degli utenti finali anziché su server cloud centralizzati.
Key Concepts
- Riduzione della latenza
- Preservazione della privacy
- Quantizzazione del modello
- Elaborazione locale
Use Cases
- Rilevamento oggetti in tempo reale per droni autonomi
- Riconoscimento vocale su altoparlanti intelligenti
- Manutenzione predittiva su sensori IoT industriali