Exploring self-distilled reasoning for supervised fine-tuning with Amazon Nova
When you fine-tune a model using Supervised Fine-Tuning (SFT), creating high-quality chain-of-thought (CoT) reasoning traces for your training data is often impractical and can be