Ouvrez ce lundi l'onglet « Modèle d'IA » d'un chatbot Causerie : la liste a gagné trois lignes, chacune marquée d'une pastille verte « NEW ». Ce n'est pas une maquette, c'est le sélecteur du dashboard tel que nous l'avons relevé le 5 octobre 2026 : onze modèles d'OpenAI, d'Anthropic, de Google et de Mistral, rangés en trois groupes. Il en comptait huit en septembre. GPT-5.6 Luna et Gemini 3.5 Flash-Lite rejoignent les modèles rapides et économiques, Claude Sonnet 5.5, sorti il y a une semaine, les modèles plus puissants. Voici ce que ces trois nouveaux valent selon leurs éditeurs, ce qui change pour un bot déjà en ligne, et pourquoi le modèle recommandé, lui, ne bouge pas.
Trois éditeurs, trois promesses très différentes
Le plus récent des trois est aussi le plus haut de gamme. Claude Sonnet 5.5, présenté par Anthropic le 28 septembre, se veut le complément plus rapide et moins cher de son modèle phare, Claude Opus 5.5. L'éditeur l'annonce plus de 30 % plus rapide que Sonnet 5 et jusqu'à 30 % moins cher sur la plupart des travaux, une économie qui vient de réponses plus efficaces : son prix au million de tokens reste celui de Sonnet 5, 2 dollars en entrée et 10 en sortie, selon la grille officielle d'Anthropic. Anthropic en fait, selon TechCrunch, un partenaire de travail nettement moins cher et plus rapide. Il prend la relève de Claude Sonnet 4.5, l'ancien modèle recommandé de Causerie, toujours dans la liste : Anthropic l'a déprécié le 30 septembre et annonce l'arrêt de son API le 30 novembre 2026.
Les deux autres jouent la vitesse. GPT-5.6 Luna est le palier le plus rapide et le plus abordable de la famille GPT-5.6, qu'OpenAI a ouverte à tous le 9 juillet en trois paliers, Sol, Terra et Luna, comme l'a détaillé Le Monde Informatique. OpenAI a ensuite divisé son prix par cinq, le 30 juillet, à 0,20 dollar par million de tokens en entrée. Gemini 3.5 Flash-Lite, disponible depuis le 21 juillet, est présenté par Google comme le plus rapide et le plus économique de sa série 3.5, pensé pour les réponses à faible latence et les gros volumes. Tous deux rejoignent GPT-4o Mini, Mistral Small, Claude Haiku 4.5 et Gemini 2.5 Flash du côté des modèles rapides.
Pourquoi le modèle recommandé reste GPT-4o Mini
La pastille attire l'œil, mais la ligne du haut ne change pas : le dashboard recommande toujours GPT-4o Mini, « rapide, fiable et le moins cher », « le bon choix pour la plupart des sites ». Sur un site de PME, les questions portent sur des horaires, des prix, des délais. La réponse est dans les pages et les PDF que le bot a reçus ; le modèle doit la retrouver et la reformuler, pas résoudre une énigme. Un modèle plus puissant écrit avec plus de nuance, mais il ne devine pas mieux une information absente de vos sources.
Les nouveaux venus élargissent le choix. GPT-5.6 Luna et Gemini 3.5 Flash-Lite sont deux alternatives récentes à GPT-4o Mini, à essayer sur vos propres questions. Claude Sonnet 5.5 prend son intérêt quand la réponse doit croiser plusieurs documents : des conditions générales, une grille tarifaire et ses exceptions, une fiche technique. Le dashboard résume ce groupe d'une phrase : « Plus coûteux : utiles pour des sujets très techniques. »
Changer de moteur sans toucher au bot
Pour un bot déjà en ligne, rien ne bouge tant que vous ne changez rien : il garde le modèle qu'il avait. Le changement, quand vous le décidez, se fait dans l'onglet Cerveau du bot et s'applique aux conversations suivantes. Le bot garde ses sources, ses consignes et son historique, et la ligne de script installée sur le site ne change pas. Si votre bot tourne sur Claude Sonnet 4.5, c'est le moment de le comparer à Sonnet 5.5. Le plan Gratuit donne accès aux modèles rapides, les plans Pro et Business aux onze, et le prix du forfait ne dépend pas du modèle : il se compte en conversations. Le détail des onze, groupe par groupe, est sur la page des modèles IA de Causerie.
Ce que trois modèles de plus ne règlent pas
Onze modèles, ce sont onze façons de rédiger une réponse à partir du même dossier. Le dossier, lui, reste le vôtre. Si une page de votre site a changé depuis son import, le bot répondra avec l'ancienne version, quel que soit le modèle : une page importée est une copie, à réimporter quand elle évolue. Si vos consignes ne disent pas quoi faire face à une question hors sujet, aucun modèle ne devinera ce que vous attendez de lui. Avant de changer, la méthode reste la même : dix vraies questions, deux modèles, les mêmes sources, et l'on garde le plus simple qui répond juste. Notre guide Chatbot IA : quel modèle choisir la détaille pas à pas.
La leçon tient en une phrase : un modèle d'IA est un fournisseur, et l'on change de fournisseur plus facilement que de contenus. Ces trois lignes de plus dans le menu sont une bonne nouvelle pour qui veut comparer, à condition de comparer sur ce qui compte. Alors, avant de cocher une pastille « NEW » : avez-vous déjà posé vos dix questions les plus fréquentes à deux modèles différents ?
