#amazon-nova

Cómo la auto-distilación de razonamiento ayuda a personalizar modelos Nova sin perder capacidades
Machine Learning 6 min lectura

Cómo la auto-distilación de razonamiento ayuda a personalizar modelos Nova sin perder capacidades

Entrenar con Supervised Fine-Tuning (SFT) en datasets sin trazas de razonamiento puede hacer que modelos potentes como Amazon Nova 2 olviden habilidades previas. Self-Distilled Reasoning (SDR) reutiliza las trazas de pensamiento del modelo base para mantener y a veces mejorar el desempeño objetivo sin necesidad de un maestro externo ni anotación humana.