Un modèle de raisonnement est un modèle de langage entraîné, notamment par apprentissage par renforcement, à produire une réflexion intermédiaire avant de répondre : il décompose le problème, teste des pistes et vérifie son résultat. Plus fiable en mathématiques, en code ou en analyse, il est aussi plus lent et plus coûteux. OpenAI o1 (2024) et DeepSeek-R1 (2025) ont ouvert la voie.
En pratique chez Gensai
Gensai réserve les modèles de raisonnement aux tâches qui le justifient, comme l'analyse de dossiers complexes, et confie les réponses simples à des modèles plus rapides.
Dans le même thème
LLM (Large Language Model)SLM (Small Language Model)DLLM (Diffusion Large Language Model)Hallucination (IA)Prompt chainingModèle préentraînéModèle de fondationIA générativeTransformerTokenFenêtre de contextePromptPrompt engineeringContexte (IA)Mémoire (IA)Fine-tuningOpen-weightQuantizationDistillationLoRA (Low-Rank Adaptation)Mixture of Experts (MoE)Température (IA)