reasoning des réponses. Pour les modèles sans raisonnement, la valeur de ce champ est null.
Modèles pris en charge avec raisonnement
Le tableau suivant répertorie les modèles Serverless Inference capables de renvoyer une sortie de raisonnement, ainsi que le comportement de chacun :- Toujours activé : le modèle renvoie systématiquement une sortie de raisonnement. Vous ne pouvez pas la désactiver.
- Activé par défaut / Désactivé par défaut : vous pouvez activer ou désactiver la sortie de raisonnement. Le tableau indique la valeur par défaut appliquée lorsque vous ne spécifiez aucun paramètre.
- Adaptatif ; le modèle choisit par défaut : le modèle décide, pour chaque requête, s’il renvoie ou non une sortie de raisonnement. Vous pouvez redéfinir ce comportement.
Modèles dont le raisonnement est Toujours activé
Si un modèle est indiqué comme Toujours activé dans le tableau Modèles pris en charge ci-dessus, il inclut systématiquement le raisonnement et vous ne pouvez pas le désactiver.
Désactiver le raisonnement
Si un modèle est indiqué commeActivé par défaut dans le tableau Modèles pris en charge ci-dessus, vous pouvez désactiver le raisonnement pour réduire l’utilisation des jetons ou simplifier la réponse. Pour désactiver le raisonnement sur une requête, définissez l’indicateur enable_thinking sur False (Python) ou false (Bash) dans chat_template_kwargs. Une fois la requête terminée, la réponse ne contient pas le contenu du raisonnement :
- Python
- Bash
Activer le raisonnement
Si un modèle porte la mentionDésactivé par défaut dans le tableau Modèles pris en charge ci-dessus, vous pouvez activer le raisonnement en définissant l’indicateur enable_thinking sur True (Python) ou true (Bash) dans l’extrait de code précédent.