Corso AI in 10 puntate

Cosa sono i guardrail (nell’AI)?

I guardrail sono regole e filtri intorno a un LLM per limitare cosa può dire o fare: rifiuti su temi pericolosi, blocchi su dati sensibili, limiti sugli tools che un agente può chiamare. Stanno sul prodotto, non solo «dentro» i pesi del modello.

Servono perché un foundation model grezzo è generico: può seguire istruzioni sbagliate o uscire dal tono. L’allineamento (tipo RLHF) è una parte; i guardrail sono controlli runtime (policy, classificatori, allowlist). Non sostituiscono il buon senso dell’utente.

Cosa non è

Non sono una garanzia assoluta: si aggirano, a volte. Non sono RAG. Non sono il system prompt da soli (anche se spesso ci lavorano insieme). Non eliminano le allucinazioni su fatti.

Nel corso si vede perché «il modello» e «il prodotto sicuro da usare» non sono la stessa cosa.

Poi, se vuoi la mappa intera. Inizia dalla puntata gratis. Il Corso AI in 10 puntate costa 9,90 € una tantum, e resta tuo. Home: corso-intelligenza-artificiale.com.