| DeepSeek V4.1-Flash | deepseek-ai/DeepSeek-V4.1-Flash | Texte, Vision | 1049k | 16B-552B (Actifs-Total) | DeepSeek V4.1 Flash est un modèle MoE multimodal conçu pour la programmation, le raisonnement et les charges de travail agentiques nécessitant de longs contextes. |
| DeepSeek V4-Flash-0731 | deepseek-ai/DeepSeek-V4-Flash-0731 | Texte | 262k | 13B-284B (Actifs-Total) | DeepSeek V4-Flash-0731 est un modèle MoE particulièrement adapté à la programmation, au raisonnement et aux charges de travail agentiques. |
| DeepSeek V4-Pro-0813 | deepseek-ai/DeepSeek-V4-Pro-0813 | Texte | 1049k | 49B-1.6T (Actifs-Total) | DeepSeek V4-Pro-0813 est un modèle MoE doté de 1.6T paramètres qui excelle dans le raisonnement avancé, la programmation et l’exécution de charges de travail agentiques complexes. |
| DeepSeek V3.1 | deepseek-ai/DeepSeek-V3.1 | Texte | 161k | 37B-671B (Actifs-Total) | Un modèle hybride de grande taille qui prend en charge les modes avec et sans raisonnement à l’aide de modèles de prompts. |
| Google Gemma 4 31B | google/gemma-4-31B-it | Texte, vision | 262k | 31 Md (Total) | Gemma 4 31B Dense est conçu pour le raisonnement avancé, les flux de travail agentiques et les contextes plus longs. Il est entraîné dès l’origine dans plus de 140 langues. |
| Google Gemma 4 26B A4B Instruct | google/gemma-4-26B-A4B-it | Texte, vision | 262k | 4B-26B (Actifs-Total) | Gemma 4 26B A4B est un modèle MoE multimodal prenant en charge LoRA et l’appel de fonctions pour les flux de travail agentiques. |
| IBM Granite 4.2 8B | ibm-granite/granite-4.2-8b | Texte | 131k | 8B (Total) | Granite 4.2 8B est un modèle entraîné à suivre des instructions, doté de capacités améliorées pour l’appel d’outils, le suivi des instructions et le chat. |
| Meta Llama 3.3 70B | meta-llama/Llama-3.3-70B-Instruct | Texte | 128k | 70B (total) | Modèle multilingue qui excelle dans les tâches conversationnelles, le respect d’instructions détaillées et la programmation. |
| Meta Llama 3.1 8B | meta-llama/Llama-3.1-8B-Instruct | Texte | 131k | 8B (Total) | Modèle conversationnel efficace, optimisé pour des échanges rapides avec un chatbot multilingue. |
| MiniMax M3 | MiniMaxAI/MiniMax-M3 | Texte, Vision | 262k | 23B-428B (Actifs-Total) | MiniMax M3 est un modèle MoE multimodal doté de 23 milliards de paramètres actifs, optimisé pour la programmation et les flux de travail agentiques. |
| Moonshot AI Kimi K2.7 Code | moonshotai/Kimi-K2.7-Code | Texte, Vision | 262k | 32B-1T (Actifs-Total) | Kimi K2.7 Code est un modèle MoE à 1 000 milliards de paramètres, dont 32 milliards de paramètres actifs, spécialement conçu pour les tâches de programmation agentique et de génie logiciel de longue durée. |
| Moonshot AI Kimi K2.6 | moonshotai/Kimi-K2.6 | Texte, vision | 262k | 32B-1T (actifs-total) | Kimi K2.6 est un modèle de langage multimodal à mélange d’experts doté de 32 milliards de paramètres actifs, pour un total de 1 000 milliards de paramètres. |
| NVIDIA Nemotron 3.5 Lightning | nvidia/NVIDIA-Nemotron-3.5-Lightning-30B-A3B | Texte | 262k | 3B-30B (Actifs-Total) | Nemotron 3.5 Lightning est un modèle MoE conçu pour exécuter des tâches agentiques avec rapidité et fiabilité dans des domaines tels que les services financiers, la cybersécurité, les télécommunications et le commerce de détail. |
| NVIDIA Nemotron 3 Ultra | nvidia/NVIDIA-Nemotron-3-Ultra-550B-A55B | Texte | 262k | 55B-550B (Actifs-Total) | Nemotron 3 Ultra est un puissant modèle MoE conçu pour des agents exécutant des tâches de longue durée en programmation, en recherche approfondie et en automatisation en entreprise. |
| OpenAI GPT OSS 120B | openai/gpt-oss-120b | Texte | 131k | 5.1B-117B (Actifs-Total) | Modèle performant à mélange d’experts conçu pour les tâches de raisonnement avancé, les applications agentiques et les usages généralistes. |
| OpenAI GPT OSS 20B | openai/gpt-oss-20b | Texte | 131k | 3.6B-20B (Actifs-Total) | Modèle à mélange d’experts à latence réduite, entraîné sur le format de réponse Harmony d’OpenAI et doté de capacités de raisonnement. |
| Qwen3.8 27B | Qwen/Qwen3.8-27B | Texte, vision | 262k | 27B (Total) | Qwen3.8-27B est un modèle multimodal dense adapté à la programmation, à la recherche, à la vision et aux tâches de longue durée exécutées par des agents. |
| Qwen3.6 35B A3B | Qwen/Qwen3.6-35B-A3B | Texte, vision | 262k | 3B-35B (actifs-total) | Qwen3.6-35B-A3B est un modèle multimodal MoE doté d’une fenêtre de contexte de 262K, optimisé pour les flux de travail de programmation agentique. |
| Z.AI GLM 5.3 Flash | zai-org/GLM-5.3-Flash | Texte, Vision | 1049k | 18B-320B (Actifs-Total) | GLM-5.3-Flash est un modèle nativement multimodal qui compte 320 milliards de paramètres au total, dont 18 milliards de paramètres actifs. |
| Z.AI GLM 5.2 | zai-org/GLM-5.2 | Texte | 1049k | 40B-744B (Actifs-Total) | GLM-5.2 est un modèle de langage à mélange d’experts qui compte 40 milliards de paramètres actifs sur un total de 744 milliards. |