Cos’è il SFT (supervised fine-tuning)?
SFT (Supervised Fine-Tuning) è un fine-tuning su coppie «domanda → risposta buona»: dopo il pretraining (completa testo a caso) il LLM impara a rispondere come un assistente. È il passo instruct: da modello nudo a modello che segue un prompt.
Serve perché il pretraining da solo non basta per una chat utile. Molti checkpoint «instruct» o «chat» nascono così, prima di RLHF o DPO. Non gli insegna i fatti di ieri: gli insegna come rispondere. Per i dati tuoi resta più adatto il RAG.
Cosa non è
Non è il pretraining. Non è RAG. Non è LoRA in sé (LoRA è un modo leggero di fare SFT). Non toglie le allucinazioni. Non è il system prompt: quello è testo in chat, non un cambio dei parametri.
Nel corso si vede la catena: pretraining → SFT → allineamento, e dove entra ciò che gli passi tu.
Poi, se vuoi la mappa intera. Inizia dalla puntata gratis. Il Corso AI in 10 puntate costa 9,90 € una tantum, e resta tuo. Home: corso-intelligenza-artificiale.com.