Causerie

⚖️ Comprendre l'IA · 11 min de lecture

Chatbot IA : quel modèle choisir en 2026 ?

GPT-5.6, Claude, Gemini 3.5 ou Mistral : quel modèle choisir pour le chatbot de votre site ? Les critères, les onze modèles et une méthode de test.

Par Mathias Igonenc, cofondateur de Causerie · mis à jour le 5 octobre 2026

Les mains d'un gérant en pull bleu nuit comparent quatre petites tasses blanches alignées sur une table claire et tiennent une cuillère vert d'eau au-dessus de celle cerclée de vertPhoto générée par IA
Comme une dégustation : la même question posée à plusieurs modèles, et vos vraies questions pour trancher.
Sommaire · 8 sections

« Quel modèle d'IA mettre derrière mon chatbot ? » La question arrive dès qu'un outil propose le choix, et Causerie en propose onze, de GPT-4o Mini à Claude Sonnet 5.5. Bonne nouvelle : pour un chatbot de site web, l'écart entre les modèles compte moins que vos contenus. Moins bonne nouvelle : aucun modèle n'est le meilleur en tout. Ce guide donne les critères qui départagent vraiment, ce que valent les onze modèles proposés au 5 octobre 2026, et une méthode de test en trente minutes sur vos propres questions. Causerie l'édite : nous disons aussi quels autres outils laissent choisir le modèle.

En bref

Pour la plupart des sites de PME, un modèle rapide suffit : GPT-4o Mini, que le dashboard de Causerie recommande, ou l'un des nouveaux venus, GPT-5.6 Luna et Gemini 3.5 Flash-Lite. Passez à un modèle plus puissant, Claude Sonnet 5.5, GPT-4o, Gemini 2.5 Pro ou Mistral Large, quand les réponses doivent croiser une documentation dense, technique ou contractuelle. Prenez Mistral quand vos clients demandent qui a conçu l'IA qui leur répond. Et tranchez sur vos propres questions, pas sur un classement : le même bot, les mêmes sources, deux modèles, dix questions.

Pourquoi le modèle compte moins que vos contenus

Un chatbot de site web assemble trois couches : vos contenus (pages, PDF, textes), vos consignes (le ton, les sujets interdits, ce qu'il doit faire quand il ne sait pas) et le modèle de langage qui rédige la réponse. À chaque question, le bot va chercher dans vos contenus les passages utiles et les transmet au modèle avec vos consignes : c'est le principe du RAG, expliqué pas à pas dans comment fonctionne un chatbot IA.

Conséquence directe : le modèle ne sait de votre entreprise que ce que vous lui donnez. Un modèle puissant nourri d'une page d'accueil vague répondra moins bien qu'un modèle rapide nourri d'une FAQ précise, de vos tarifs et de vos conditions. Si votre bot invente, le premier réflexe n'est pas de changer de modèle, c'est de compléter les sources et de resserrer les consignes, comme le détaille le guide pour empêcher un chatbot d'inventer. Le modèle fait la différence à la marge, sur les questions qui demandent de croiser plusieurs documents ou de nuancer.

Les quatre critères qui départagent les modèles

  • ✓La vitesse. Un visiteur qui pose une question sur un site attend une réponse en quelques secondes, pas un rapport. Les modèles rapides écrivent plus vite, et sur un site très fréquenté, la seconde gagnée se multiplie par des milliers de conversations. Le sélecteur de Causerie note la vitesse de chaque modèle sur trois points.
  • ✓La finesse sur les sujets complexes. Croiser des conditions générales, une grille tarifaire et une exception, expliquer une garantie, comparer deux offres : c'est là que les modèles puissants se distinguent. Le dashboard les présente comme « plus coûteux », « utiles pour des sujets très techniques ».
  • ✓Le respect des consignes. Un bon modèle de chatbot suit vos règles, reste dans son sujet et dit « je ne sais pas » plutôt que d'improviser un prix ou un délai. Ce critère ne se lit dans aucune fiche technique : il se teste, sur vos questions pièges.
  • ✓L'origine du modèle. OpenAI, Anthropic et Google sont américains, Mistral AI est français. Quand un client, un acheteur public ou un service juridique demande qui a conçu l'IA, la réponse « un modèle français » tient en une ligne. Notre page sur le chatbot Mistral détaille ce que ce choix change, et ne change pas.

Le coût, enfin, dépend de l'outil. Les éditeurs de modèles facturent à l'usage, et un modèle puissant coûte plusieurs fois plus cher qu'un modèle rapide à volume égal. Certains outils de chatbot répercutent cet écart sur votre facture, en crédits qui fondent plus vite avec les gros modèles. Chez Causerie, le forfait se compte en conversations et ne change pas avec le modèle : le plan Gratuit donne les modèles rapides, Pro et Business donnent les onze.

Les onze modèles de Causerie, un par un

Voici les onze modèles du sélecteur de Causerie au 5 octobre 2026, dans l'ordre où le dashboard les affiche, avec la vitesse qu'il leur attribue. Les repères viennent des pages officielles des éditeurs ; les prix sont ceux que facturent OpenAI, Anthropic, Google et Mistral aux développeurs, par million de tokens (les fragments de mots que comptent les modèles) en entrée puis en sortie. Ce n'est pas ce que vous payez chez Causerie, où le forfait ne dépend pas du modèle.

ModèleÉditeurGroupeVitesseRepères de l'éditeur
GPT-4o MiniOpenAIRecommandé●●●OpenAI, juillet 2024. Petit modèle rapide et abordable pour des tâches ciblées. 0,15 $ / 0,60 $.
GPT-5.6 LunanouveauOpenAIRapide et économique●●●OpenAI, 9 juillet 2026. Le palier le plus rapide et le plus abordable de GPT-5.6. 0,20 $ / 1,20 $ depuis la baisse du 30 juillet.
Gemini 3.5 Flash-LitenouveauGoogleRapide et économique●●●Google, 21 juillet 2026. Le plus rapide et le plus économique de la série 3.5, pour les réponses à faible latence. 0,30 $ / 2,50 $.
Mistral SmallMistral · FranceRapide et économique●●●Mistral AI, éditeur français. Dernière version : Small 4, 16 mars 2026, poids ouverts. 0,15 $ / 0,60 $.
Claude Haiku 4.5AnthropicRapide et économique●●●Anthropic, 15 octobre 2025. Le plus rapide de la gamme Claude. 1 $ / 5 $.
Gemini 2.5 FlashGoogleRapide et économique●●●Google, juin 2025. Classé « Legacy » par Google, qui conseille Gemini 3.5 Flash-Lite pour un nouveau projet. 0,30 $ / 2,50 $.
Claude Sonnet 5.5nouveauAnthropicPlus puissant●●●Anthropic, 28 septembre 2026. Plus de 30 % plus rapide que Sonnet 5 selon l'éditeur. 2 $ / 10 $.
Mistral LargeMistral · FrancePlus puissant●●●Mistral AI, éditeur français. Dernière version : Large 3, 2 décembre 2025, poids ouverts. 0,50 $ / 1,50 $.
Claude Sonnet 4.5AnthropicPlus puissant●●●Anthropic, septembre 2025. Déprécié le 30 septembre 2026 : arrêt annoncé le 30 novembre 2026, au profit de Sonnet 5.5. 3 $ / 15 $.
GPT-4oOpenAIPlus puissant●●●OpenAI, mai 2024. Le modèle polyvalent de 2024, toujours disponible. 2,50 $ / 10 $.
Gemini 2.5 ProGooglePlus puissant●●●Google, juin 2025. Raisonnement poussé, classé « Legacy » par Google. 1,25 $ / 10 $.

Sources : pages modèles, tarifs et dépréciations d'OpenAI, d'Anthropic, de Google et de Mistral AI, consultées le 5 octobre 2026. Les prix d'Anthropic ne se comparent pas tout à fait d'une génération à l'autre : selon sa page tarifs, ses modèles récents comptent environ 30 % de tokens de plus pour un même texte.

Ce que le tableau dit en clair. D'abord, le prix d'un modèle varie de un à vingt entre le moins cher et le plus cher des onze, de 0,15 à 3 dollars par million de tokens en entrée : c'est l'écart qui explique que certains outils facturent les gros modèles plus cher. Ensuite, trois modèles arrivent en fin de cycle chez leur éditeur. Anthropic a déprécié Claude Sonnet 4.5 le 30 septembre et annonce l'arrêt de son API le 30 novembre 2026 ; Google range Gemini 2.5 Flash et Gemini 2.5 Pro parmi ses modèles « Legacy » et conseille, pour un nouveau projet, Gemini 3.5 Flash-Lite ou Gemini 3.8 Flash. Pour un nouveau bot, leurs successeurs sont déjà dans la liste : Claude Sonnet 5.5 et Gemini 3.5 Flash-Lite. Enfin, GPT-4o Mini, le modèle recommandé, date de 2024 : il reste le moins cher avec Mistral Small, et les nouveaux venus sont faits pour être comparés avec lui.

Quel modèle selon votre site

  • ✓Site vitrine, artisan, profession libérale, commerce local : horaires, prestations, prix indicatifs, prise de contact. Le modèle recommandé, GPT-4o Mini, ou Mistral Small si vous voulez un modèle français.
  • ✓Boutique en ligne : livraison, retours, disponibilités, conseils produit. Un modèle rapide pour tenir les pics de trafic ; testez un modèle puissant si vos fiches produit sont techniques.
  • ✓Documentation dense : organisme de formation, assurance, industrie, logiciel, conditions contractuelles. Comparez un modèle rapide et un modèle puissant, Claude Sonnet 5.5, Gemini 2.5 Pro ou Mistral Large, sur vos questions les plus pointues. Le guide du chatbot pour grosse documentation donne la méthode côté sources.
  • ✓Secteur où l'on vous demande d'où vient l'IA : santé, collectivités, juridique, finance. Mistral Small ou Mistral Large, et des consignes strictes sur ce que le bot ne doit jamais dire.
  • ✓Clientèle internationale : les onze modèles comprennent et rédigent dans les grandes langues européennes, mais pas tous avec la même aisance ; testez dans la langue de vos visiteurs, pas seulement en français.

Quels chatbots laissent choisir le modèle

Causerie n'est pas le seul outil à ouvrir le choix du modèle, et ce n'est pas celui qui en propose le plus. Voici ce que disent les documentations officielles de douze outils, consultées le 5 octobre 2026. Deux questions comptent autant que la liste : le modèle choisi change-t-il ce que vous payez, et un modèle français est-il proposé ?

OutilChoix du modèleEffet sur le prixMistral
CauserieOui : onze modèles d'OpenAI, Anthropic, Google et Mistral, changeables à tout momentAucun : le forfait se compte en conversations. Le plan Gratuit donne les modèles rapidesOui, Small et Large
ChatbaseOui : des dizaines de modèles (OpenAI, Anthropic, Google, xAI, DeepSeek, Mistral…) et un mode automatiqueDe 1 à 6 crédits par réponse selon le modèle ; choix restreint en gratuitOui
ChatlingOui : plus de 40 modèles, réglables bot par bot et bloc par blocDe 0,5 à 25 crédits par réponse selon le modèleOui, Small 4 et Large 3
BotpressOui : intégrations OpenAI, Anthropic, Google, Mistral AI, Groq et d'autresUsage IA refacturé au prix du fournisseurOui, par intégration
Crisp (Hugo)Oui : mode automatique ou choix manuel parmi OpenAI, Anthropic, Google, Mistral et des modèles hébergés par CrispCrédits IA consommés plus ou moins vite selon le modèleOui
VoiceflowOui : modèle par défaut au choix (modèle maison, Claude, GPT, Gemini…)Crédits variables selon le fournisseur et le modèleNon, sauf appel manuel à son API
SiteGPTPartiel : GPT-4.1 ou GPT-4.1 mini, d'OpenAIUn message GPT-4.1 compte pour dixNon
CustomGPT.aiPartiel : choix du modèle réservé à l'offre EnterpriseNon documentéNon
Tidio (Lyro)Non : Claude d'Anthropic et des modèles maisonSans objetNon
Fin (ex-Intercom)Non : son modèle maison, Apex 1.0, rédige les réponsesSans objetNon
ZendeskNon : Zendesk choisit le modèle fonction par fonctionSans objetNon mentionné
HubSpot (Customer Agent)Non : aucun sélecteur documentéSans objetNon

Trois lectures de ce tableau. Les outils qui proposent le plus de modèles, Chatbase et Chatling, facturent en crédits : un gros modèle y consomme jusqu'à six fois (Chatbase) ou cinquante fois (Chatling) plus qu'un petit, et le budget suit le choix. Les suites de support les plus connues, Tidio, Fin (ex-Intercom), Zendesk et HubSpot, choisissent le modèle à votre place : c'est un confort, mais vous ne pouvez ni comparer ni opter pour un modèle français. Enfin, Mistral n'est proposé que par une minorité d'outils : Causerie, Chatbase, Chatling, Botpress et Crisp.

La méthode : tester deux modèles en trente minutes

Les classements de modèles mesurent surtout du raisonnement, des mathématiques ou du code, pas la question qu'un client pose sur vos délais de livraison. Le seul test qui compte se fait sur votre bot, avec vos sources. Dans Causerie, l'onglet Tester du bot sert à ça, et le changement de modèle se fait dans l'onglet Cerveau, sans rien réinstaller.

  • ✓Écrivez dix vraies questions : les sept que vos clients posent le plus souvent, plus trois pièges. Une question dont la réponse n'est pas dans vos contenus, une question hors sujet, une demande de prix ou de délai que vous ne voulez pas voir improvisée.
  • ✓Posez-les avec le modèle recommandé, GPT-4o Mini, et notez chaque réponse : juste, incomplète ou inventée.
  • ✓Changez de modèle et reposez les mêmes questions, mot pour mot : un modèle rapide plus récent, puis un modèle puissant si les réponses du premier manquent de précision.
  • ✓Comparez sur trois points : l'exactitude, le respect des pièges (le bot dit-il qu'il ne sait pas ?) et le temps de réponse.
  • ✓Gardez le plus simple qui passe le test, puis relisez les vraies conversations au bout d'une semaine : ce sont elles qui diront si le choix tient.

Ce qu'aucun modèle ne corrige

Une information absente de vos sources, une consigne floue, une page importée puis modifiée sur le site sans être réimportée : aucun modèle, si puissant soit-il, ne répondra juste. Si le test révèle des trous, comblez-les avant de changer de modèle.

Questions fréquentes

Quel est le meilleur modèle d'IA pour un chatbot de site web ? Il n'y en a pas un seul. Pour la plupart des sites de PME, un modèle rapide suffit : GPT-4o Mini, que Causerie recommande, ou GPT-5.6 Luna, Gemini 3.5 Flash-Lite, Mistral Small et Claude Haiku 4.5. Pour une documentation dense ou contractuelle, un modèle puissant : Claude Sonnet 5.5, GPT-4o, Gemini 2.5 Pro ou Mistral Large. Le bon choix se décide en testant deux modèles sur vos dix questions les plus fréquentes.

GPT ou Claude pour un chatbot ? Les deux font de très bons chatbots quand les sources sont bonnes. Les écarts se voient sur le ton, la longueur des réponses et la façon de dire « je ne sais pas » : ils se mesurent sur vos questions, pas dans l'absolu. Dans Causerie, on passe de l'un à l'autre depuis l'onglet Cerveau du bot, qui garde ses sources et ses consignes.

Mistral est-il assez bon pour un chatbot en français ? Oui pour un site de PME, où les questions portent sur des horaires, des tarifs, des procédures et la prise de contact. Mistral Small couvre l'essentiel, Mistral Large apporte plus de nuance sur une documentation complexe. Son atout distinctif est son origine : Mistral AI est un éditeur français.

Un modèle plus puissant fait-il un meilleur chatbot ? Pas forcément. Il apporte de la nuance quand il faut croiser plusieurs documents, mais il répond plus lentement, coûte plus cher à l'usage et ne devine pas une information absente de vos sources. Sur des questions factuelles, un modèle rapide bien nourri suffit le plus souvent.

Le choix du modèle change-t-il le prix d'un chatbot ? Chez les éditeurs de modèles, oui : un modèle puissant coûte plusieurs fois plus cher par million de tokens qu'un modèle rapide. Chez les outils de chatbot, cela dépend : certains comptent des crédits qui fondent plus vite avec les gros modèles. Chez Causerie, le forfait se compte en conversations et ne change pas avec le modèle ; le plan Gratuit donne les modèles rapides, Pro et Business donnent les onze.

Peut-on changer de modèle sans refaire son chatbot ? Dans Causerie, oui : le changement se fait dans l'onglet Cerveau du bot et s'applique aux conversations suivantes. Le bot garde ses sources, ses consignes et son historique, et le script installé sur le site ne change pas.

Quels chatbots permettent de choisir le modèle d'IA ? D'après leur documentation au 5 octobre 2026 : Causerie (onze modèles d'OpenAI, Anthropic, Google et Mistral, au même prix), Chatbase et Chatling (des dizaines de modèles, en crédits qui varient selon le modèle), Botpress (au prix du fournisseur), Crisp avec son agent Hugo, et Voiceflow. SiteGPT se limite à deux modèles d'OpenAI et CustomGPT.ai réserve le choix à son offre Enterprise. Tidio, Fin (ex-Intercom), Zendesk et l'agent client de HubSpot choisissent le modèle à votre place.

Qu'est-ce que GPT-5.6 Luna ? Le palier le plus rapide et le plus abordable de la famille GPT-5.6 d'OpenAI, disponible pour tous depuis le 9 juillet 2026 ; OpenAI le rapproche de l'ancien palier « nano ». Il coûte 0,20 dollar par million de tokens en entrée et 1,20 en sortie depuis la baisse de prix du 30 juillet 2026. Il fait partie des modèles rapides de Causerie depuis début octobre 2026.

Lancez votre bot. Avant la fin de votre café.

5 minutes pour installer. Gratuit pour toujours sur la formule de base. Sans carte bancaire, sans code, sans excuse.

Pas encore de site ? Créer mon compte gratuit →

Sans compte pour essayer · Gratuit pour toujours · Sans carte bancaire