Custodie di sicurezza (Guardrails)

term_id: guardrails

Category: application_paradigms

Definition

Le custodie di sicurezza (guardrails) si riferiscono a un insieme di controlli software e strati di applicazione delle politiche integrati nelle applicazioni AI, in particolare nei grandi modelli linguistici (LLM), per garantire un comportamento sicuro e conforme. Agiscono come filtri che monitorano e regolano le interazioni, assicurando che il sistema rispetti linee guida etiche e normative specifiche.

Summary

Meccanismi di sicurezza progettati per limitare gli output dei modelli AI, impedendo la generazione di contenuti dannosi, distorti o non autorizzati.

Key Concepts

  • Filtraggio Input/Output
  • Applicazione delle Politiche
  • Rilevamento della Tossicità
  • Difesa dall’Iniezione di Prompt

Use Cases

  • Chatbot aziendali che richiedono una rigorosa conformità al marchio
  • Assistenti sanitari che garantiscono accuratezza medica e privacy
  • Bot di assistenza clienti che prevengono l’uso di linguaggio offensivo