Le Transformer est l'architecture de réseau de neurones à l'origine des LLM actuels, introduite en 2017. Son mécanisme d'attention traite tous les mots d'un texte en parallèle en pesant leurs relations, là où les architectures précédentes lisaient séquentiellement. Le « T » de GPT, c'est lui.
En pratique chez Gensai
Tous les modèles que Gensai intègre (Mistral, Claude, GPT, Gemini) reposent sur des variantes de cette architecture.