Custodie di sicurezza (Guardrails)
term_id: guardrails
Category: application_paradigms
Definition
Le custodie di sicurezza (guardrails) si riferiscono a un insieme di controlli software e strati di applicazione delle politiche integrati nelle applicazioni AI, in particolare nei grandi modelli linguistici (LLM), per garantire un comportamento sicuro e conforme. Agiscono come filtri che monitorano e regolano le interazioni, assicurando che il sistema rispetti linee guida etiche e normative specifiche.
Summary
Meccanismi di sicurezza progettati per limitare gli output dei modelli AI, impedendo la generazione di contenuti dannosi, distorti o non autorizzati.
Key Concepts
- Filtraggio Input/Output
- Applicazione delle Politiche
- Rilevamento della Tossicità
- Difesa dall’Iniezione di Prompt
Use Cases
- Chatbot aziendali che richiedono una rigorosa conformità al marchio
- Assistenti sanitari che garantiscono accuratezza medica e privacy
- Bot di assistenza clienti che prevengono l’uso di linguaggio offensivo