Skip to main content
Les modèles de raisonnement, tels que Gemma 4 de Google, renvoient des informations sur leurs étapes de raisonnement en plus de la réponse finale. Cette page explique comment identifier les modèles de raisonnement disponibles sur Serverless Inference, où trouver la sortie de raisonnement dans une réponse, et comment activer ou désactiver le raisonnement pour les modèles qui le permettent. Utilisez ce guide pour examiner le raisonnement intermédiaire d’un modèle ou pour choisir d’afficher ou non le raisonnement dans une réponse. Pour déterminer si un modèle prend en charge le raisonnement, consultez le tableau des modèles pris en charge ci-dessous ou la section Supported Features de sa page de catalogue dans l’interface utilisateur. Les informations de raisonnement figurent dans le champ reasoning des réponses. Pour les modèles sans raisonnement, la valeur de ce champ est null.

Modèles pris en charge avec raisonnement

Le tableau suivant répertorie les modèles Serverless Inference capables de renvoyer une sortie de raisonnement, ainsi que le comportement de chacun :
  • Toujours activé : le modèle renvoie systématiquement une sortie de raisonnement. Vous ne pouvez pas la désactiver.
  • Activé par défaut / Désactivé par défaut : vous pouvez activer ou désactiver la sortie de raisonnement. Le tableau indique la valeur par défaut appliquée lorsque vous ne spécifiez aucun paramètre.
  • Adaptatif ; le modèle choisit par défaut : le modèle décide, pour chaque requête, s’il renvoie ou non une sortie de raisonnement. Vous pouvez redéfinir ce comportement.

Modèles dont le raisonnement est Toujours activé

Si un modèle est indiqué comme Toujours activé dans le tableau Modèles pris en charge ci-dessus, il inclut systématiquement le raisonnement et vous ne pouvez pas le désactiver.

Désactiver le raisonnement

Si un modèle est indiqué comme Activé par défaut dans le tableau Modèles pris en charge ci-dessus, vous pouvez désactiver le raisonnement pour réduire l’utilisation des jetons ou simplifier la réponse. Pour désactiver le raisonnement sur une requête, définissez l’indicateur enable_thinking sur False (Python) ou false (Bash) dans chat_template_kwargs. Une fois la requête terminée, la réponse ne contient pas le contenu du raisonnement :

Activer le raisonnement

Si un modèle porte la mention Désactivé par défaut dans le tableau Modèles pris en charge ci-dessus, vous pouvez activer le raisonnement en définissant l’indicateur enable_thinking sur True (Python) ou true (Bash) dans l’extrait de code précédent.
Dernière modification le 30 septembre 2026