Supervised Fine-Tuning

A technique for adapting pre-trained language models to specific tasks or domains by updating model weights using labeled input-output pairs. Involves training on a curated dataset to align model behavior with desired outputs while preserving base capabilities.

Key Implementation Details

Example: Fine-Tuning OSS-20B

References