Les huit modèles, et à quoi ils servent
Quatre éditeurs, deux tailles chacun. Les versions rapides répondent en une ou deux secondes et suffisent aux questions factuelles d'un site de PME ; les versions avancées apportent plus de nuance sur des documentations denses ou contractuelles.
- GPT-4o et GPT-4o Mini (OpenAI) : la référence du marché, très à l'aise en rédaction. Mini est le modèle rapide par défaut du plan Gratuit.
- Claude Sonnet et Claude Haiku (Anthropic) : Sonnet est le modèle recommandé par défaut : le plus fiable en contexte métier, le plus prudent quand il ne sait pas. Haiku est sa version rapide.
- Gemini 2.5 Pro et Gemini 2.5 Flash (Google) : Flash est très rapide et économe ; Pro tient bien les longues réponses structurées.
- Mistral Small et Mistral Large (Mistral AI) : l'éditeur français : avec Mistral, la chaîne est française jusqu'au modèle. Le choix des secteurs qui doivent documenter où vont les données.
Le RAG prépare le même dossier pour tous : à chaque question, les passages pertinents de vos contenus sont transmis au modèle choisi. C'est ce qui rend le changement de modèle sans risque, le bot ne réapprend rien.
Comment choisir, en pratique
Démarrez sur un modèle rapide et relisez les dix premières conversations. Si les réponses sont justes et complètes, restez-y : elles coûtent moins de temps de réponse au visiteur. Si des réponses manquent de précision sur des sujets complexes, conditions contractuelles, catalogue technique, garanties, passez sur Claude Sonnet, GPT-4o, Gemini Pro ou Mistral Large et comparez sur les mêmes questions depuis l'onglet Tester.
Deux cas tranchent d'eux-mêmes. Un client qui demande où vont ses données : Mistral, éditeur français, hébergement des conversations en Union européenne, la réponse tient en une ligne, détaillée sur la page du chatbot Mistral. Un site à très fort trafic : un modèle rapide, parce que la seconde gagnée se multiplie par mille conversations.
Ce qui ne change pas quand vous changez de modèle
Vos sources, vos consignes, l'historique des conversations, le widget, la ligne de script sur le site : rien ne bouge. Le prix non plus : le forfait dépend du volume de conversations, pas du modèle, il n'y a aucun supplément par modèle ni crédit à surveiller. Ce qui change, c'est la façon de rédiger la réponse à partir du même dossier. C'est pour ça que le choix reste réversible en un clic.
Une chose ne dépend d'aucun modèle : la qualité de vos contenus et de vos consignes. Un modèle avancé mal nourri invente autant qu'un autre. La base de connaissances et le prompt système comptent plus que le moteur.
