> ## Documentation Index
> Fetch the complete documentation index at: https://docs.coreweave.com/llms.txt
> Use this file to discover all available pages before exploring further.

# Afficher les informations de raisonnement

> Comment renvoyer et afficher le raisonnement dans vos réponses Serverless Inference

Les modèles de raisonnement, tels que [Gemma 4 de Google](https://huggingface.co/google/gemma-4-31B-it), renvoient des informations sur leurs étapes de raisonnement en plus de la réponse finale. Cette page explique comment identifier les modèles de raisonnement disponibles sur Serverless Inference, où trouver la sortie de raisonnement dans une réponse, et comment activer ou désactiver le raisonnement pour les modèles qui le permettent. Utilisez ce guide pour examiner le raisonnement intermédiaire d’un modèle ou pour choisir d’afficher ou non le raisonnement dans une réponse.

Pour déterminer si un modèle prend en charge le raisonnement, consultez le tableau des modèles pris en charge ci-dessous ou la section **Supported Features** de sa page de catalogue dans l’interface utilisateur.

Les informations de raisonnement figurent dans le champ `reasoning` des réponses. Pour les modèles sans raisonnement, la valeur de ce champ est `null`.

<h2 id="supported-models-with-reasoning">
  Modèles pris en charge avec raisonnement
</h2>

Le tableau suivant répertorie les modèles Serverless Inference capables de renvoyer une sortie de raisonnement, ainsi que le comportement de chacun :

* **Toujours activé :** le modèle renvoie systématiquement une sortie de raisonnement. Vous ne pouvez pas la désactiver.
* **Activé par défaut** / **Désactivé par défaut :** vous pouvez activer ou désactiver la sortie de raisonnement. Le tableau indique la valeur par défaut appliquée lorsque vous ne spécifiez aucun paramètre.
* **Adaptatif ; le modèle choisit par défaut :** le modèle décide, pour chaque requête, s'il renvoie ou non une sortie de raisonnement. Vous pouvez redéfinir ce comportement.

| ID du modèle (pour l’utilisation de l’API) | Prise en charge du raisonnement |
| - | - |
| `deepseek-ai/DeepSeek-V4.1-Flash` | Activé par défaut |
| `deepseek-ai/DeepSeek-V4-Flash` | Désactivé par défaut |
| `deepseek-ai/DeepSeek-V4-Flash-0731` | Activé par défaut |
| `deepseek-ai/DeepSeek-V4-Pro` | Désactivé par défaut |
| `deepseek-ai/DeepSeek-V4-Pro-0813` | Activé par défaut |
| `google/gemma-4-31B-it` | Désactivé par défaut |
| `google/gemma-4-26B-A4B-it` | Désactivé par défaut |
| `ibm-granite/granite-4.2-8b` | Activé par défaut |
| `MiniMaxAI/MiniMax-M3` | Adaptatif ; le modèle choisit par défaut |
| `moonshotai/Kimi-K2.7-Code` | Toujours activé |
| `moonshotai/Kimi-K2.6` | Toujours activé |
| `nvidia/NVIDIA-Nemotron-3.5-Lightning-30B-A3B` | Activé par défaut |
| `nvidia/NVIDIA-Nemotron-3-Ultra-550B-A55B` | Activé par défaut |
| `openai/gpt-oss-120b` | Toujours activé |
| `openai/gpt-oss-20b` | Toujours activé |
| `Qwen/Qwen3.8-27B` | Activé par défaut |
| `Qwen/Qwen3.6-35B-A3B` | Activé par défaut |
| `Qwen/Qwen3.6-27B` | Activé par défaut |
| `Qwen/Qwen3.5-35B-A3B` | Activé par défaut |
| `zai-org/GLM-5.3-Flash` | Toujours activé |
| `zai-org/GLM-5.2` | Activé par défaut |

<h3 id="models-with-always-on-reasoning">
  Modèles dont le raisonnement est `Toujours activé`
</h3>

Si un modèle est indiqué comme `Toujours activé` dans le tableau [Modèles pris en charge](#supported-models-with-reasoning) ci-dessus, il inclut systématiquement le raisonnement et vous ne pouvez pas le désactiver.

<h3 id="disable-reasoning">
  Désactiver le raisonnement
</h3>

Si un modèle est indiqué comme `Activé par défaut` dans le tableau [Modèles pris en charge](#supported-models-with-reasoning) ci-dessus, vous pouvez désactiver le raisonnement pour réduire l’utilisation des jetons ou simplifier la réponse. Pour désactiver le raisonnement sur une requête, définissez l’indicateur `enable_thinking` sur `False` (Python) ou `false` (Bash) dans `chat_template_kwargs`. Une fois la requête terminée, la réponse ne contient pas le contenu du raisonnement :

<Tabs>
  <Tab title="Python">
    ```python lines highlight={13-17} theme={"system"}
    import openai

    client = openai.OpenAI(
        base_url='https://api.inference.wandb.ai/v1',
        api_key="[YOUR-API-KEY]",  # Créez une clé API sur https://forge.coreweave.com/settings
    )

    response = client.chat.completions.create(
        model="google/gemma-4-31B-it",
        messages=[
            {"role": "user", "content": "3.11 and 3.8, which is greater?"}
        ],
        extra_body={
            "chat_template_kwargs": {
                "enable_thinking": False
            }
        },
    )
    ```
  </Tab>

  <Tab title="Bash">
    ```bash lines highlight={9} theme={"system"}
    curl https://api.inference.wandb.ai/v1/chat/completions \
      -H "Content-Type: application/json" \
      -H "Authorization: Bearer [YOUR-API-KEY]" \
      -d '{
        "model": "google/gemma-4-31B-it",
        "messages": [
          { "role": "user", "content": "3.11 and 3.8, which is greater?" }
        ],
        "chat_template_kwargs": {"enable_thinking": false}
      }'
    ```
  </Tab>
</Tabs>

<h3 id="enable-reasoning">
  Activer le raisonnement
</h3>

Si un modèle porte la mention `Désactivé par défaut` dans le tableau [Modèles pris en charge](#supported-models-with-reasoning) ci-dessus, vous pouvez activer le raisonnement en définissant l’indicateur `enable_thinking` sur `True` (Python) ou `true` (Bash) dans l’extrait de code précédent.
