Base de connaissance : le guide complet pour 2026
Découvrez ce qu'est une base de connaissance, ses types, les bonnes pratiques de conception, la gouvernance RGPD et son couplage avec LLM et RAG
58 articles sur les solutions llm pour la relation client.
Découvrez ce qu'est une base de connaissance, ses types, les bonnes pratiques de conception, la gouvernance RGPD et son couplage avec LLM et RAG
Bercy retient Mistral et écarte OpenAI pour tester ses SI publics après la fuite DGFiP. Ce que ce précédent change pour une DSI d'ETI régulée.
Apple fait entraîner son LLM chinois chez Alibaba (14 août 2026). Trois arbitrages pour une DSI française qui pilote un chatbot multi-pays.
IBM intègre GPT-5.6, Codex et ChatGPT Work dans Consulting Advantage. Les trois questions qu'une DSI française doit poser avant de signer.
Gemini 3.7 Flash sort à -50 % le 13 août 2026, 3 semaines après 3.6. Tarif promo jusqu'au 31 décembre. Rouvrir le business case chatbot avant janvier.
OpenAI lance Ultrafast : GPT-5.6 Sol jusqu'à 750 tokens/s via Cerebras, en accès restreint. Ce qu'une DSI française doit vérifier avant de chiffrer.
Mistral ouvre ses endpoints EU/US et son Priority Tier (SLA 99,5 % à +75 %). Trois limites à vérifier avant un déploiement en production.
DeepSeek a annoncé le 6 août 2026 une hausse « significative » de son API. Trois arbitrages à trancher pour votre architecture multi-LLM.
Anthropic a retiré Claude Opus 4.1 le 5 août 2026, troisième rupture Claude en huit semaines. Cadrez votre clause de version et votre plan de migration.
Alibaba annonce les poids ouverts de Qwen 3.8 Max (2,4 T MoE) mi-août 2026. Trois freins à peser avant de rouvrir votre appel d'offres agents IA T4.
OpenAI a divisé par 5 le prix de GPT-5.6 Luna le 30 juillet 2026. Recalculez la ligne LLM de votre business case chatbot avant de signer.
La Maison Blanche accuse Moonshot d'avoir distillé Fable pour bâtir Kimi K3. Les trois lignes à ajouter à votre appel d'offres LLM avant tout pilote.
Google baisse le prix de sortie à 7,50 $/M et génère 17 % de tokens en moins. Recalculez le coût complet de votre chatbot avant tout engagement 2027.
Poids Kimi K3 publiés le 27 juillet sur Hugging Face : 1,56 To, licence spécifique, 104 Md de paramètres actifs. Ce que votre DSI doit trancher.
OpenAI a lancé GPT-Live full-duplex dans ChatGPT le 8 juillet 2026, mais l'API entreprise reste fermée. Le calendrier réaliste pour votre callbot.
Mistral ouvre en juillet l'accès à un nouveau MoE open-weight. Ce qu'une DSI d'ETI française doit préparer avant de signer son stack LLM Q4 2026.
OpenAI dote son mini vocal du raisonnement et des outils, à 3× moins cher, et baisse la latence p95 de 25 %. Ce que ça change pour votre callbot.
Anthropic rend permanent le tarif 2/10 $ de Sonnet 5 (annonce du 10 août 2026). La hausse à 3/15 $ prévue au 1er septembre n'aura pas lieu.
Anthropic redéploie Claude Fable 5 le 1er juillet 2026, tarif inchangé. Ce que la levée des contrôles change, et ne change pas, pour votre sélection LLM.
OpenAI a rouvert l'accès à GPT-5.6 en France le 9 juillet 2026. Le verrou américain peut retomber : sécurisez votre contrat LLM avant octobre.
Anthropic accuse des opérateurs liés à Alibaba et son labo Qwen de 28,8 M d'appels frauduleux sur Claude entre avril et juin 2026. Alibaba dément.
Mistral OCR 4 sort le 23 juin 2026 en API et en conteneur on-premise : l'arbitrage que vos DSI assurance, mutuelle et banque doivent trancher avant la rentrée.
L'interdiction US Fable 5 et Mythos 5 du 12 juin oblige toute ETI française à rouvrir ses clauses LLM. Anatomie d'une fenêtre d'arbitrage de 90 jours.
Bloomberg rapporte le 12 juin 2026 des discussions early-stage pour lever ~3 Md€ à ~20 Md€ de valo. Ce que ça change pour l'arbitrage LLM sous DORA.
Anthropic ouvre Claude Fable 5 le 9 juin 2026 : 10/50 $ par M tokens, fallback Opus 4.8 sur cyber et bio, gratuit Pro/Max/Team/Enterprise jusqu'au 22 juin.
Mistral retire Le Chat pour Vibe, signe Airbus 5 ans, BMW, ASML, EDF, CMA CGM et démarre Bruyères-le-Châtel. Ce que ça change pour une DSI française.
Harvey ouvre Mistral en accès anticipé à ses clients UE (26 mai 2026), avec inférence hébergée en Europe. Ce que ce signal change pour les ETI.
DeepSeek remplace son prix permanent par une grille horaire : +52 % à +1 114 % dès le 16 août 2026. Comment réviser votre routage multi-LLM.
Mistral rachète Emmi AI et ses modèles physiques d'ingénierie. Ce que cette opération change — et ne change pas — pour un industriel français.
Bpifrance déploie Le Chat de Mistral à tous ses collaborateurs. Pourquoi ce signal public change l'arbitrage IA des PME et ETI françaises en 2026.
Benchmarks, prix réel, premiers retours : analysez Gemini 3.5 Flash avant de remplacer Claude, GPT ou Gemini 3.1 Pro.
Gemini 3.1 Flash-Lite passe en GA le 7 mai 2026 : 0,25 $ / 1,50 $ par million de tokens, contexte 1M, 2,5x plus rapide. Quoi en faire pour un chatbot ETI.
GPT-Realtime-2 sort le 7 mai 2026 avec contexte 128K, 5 niveaux de raisonnement et la Realtime API en GA. Ce qu'un DSI français doit cadrer avant de signer.
NVIDIA lance Nemotron 3 Nano Omni : 30B paramètres open-source, 9x plus rapide. Comprenez l'impact pour vos agents IA d'entreprise.
Kimi K2.6 orchestre 300 agents et bat GPT-5.4 sur SWE-bench Pro. Benchmarks, prix et impact pour les DSI français.
DeepSeek V4-Pro sort sous licence MIT : 80,6% SWE-bench, 1,6T paramètres, 3,48$/M tokens contre 25$ pour Claude. L'open source rattrape les modèles fermés.
xAI lance Grok Voice Think Fast 1.0, n°1 sur τ-voice Bench, déployé chez Starlink avec 70% de résolution autonome. Impact sur vos projets callbot.
Alibaba publie Qwen 3.6-27B sous Apache 2.0 : il surpasse son propre modèle 14× plus gros sur le coding. Ce que ça change pour les DSI.
GPT-5.5 atteint 98% sur les workflows service client et orchestre ses outils seul. Ce que les DSI français doivent en retenir.
DeepSeek V4 Pro et Flash sortent en open source. À 0,14$/M tokens, le coût d'inférence chute de ÷35 face à GPT-5.5 pour les agents IA.
Alibaba open-source Qwen 3.6-35B-A3B, un modèle MoE qui rivalise avec GPT-5 mini pour 0,38$ le million de tokens.
Analysez GPT-5.5 sorti le 23 avril : coding agentique, computer use et impact concret pour vos workflows IA d'entreprise.
Alibaba lance Qwen3.6-Max-Preview, premier sur 6 benchmarks coding. Analysez ce que la montée des LLM chinois change pour les DSI français.
Décryptez Mistral Medium 3 lancé le 9 avril 2026 — open weights, conformité EU AI Act native, et ce que ça change pour les ETI françaises régulées.
MiniMax M2.7 atteint 56,2% SWE-Pro avec 10B paramètres actifs et s'auto-améliore en 100 rounds autonomes. Analysez l'impact.
Anthropic lance Opus 4.7 avec +7 pts SWE-bench et vision 98,5%. Analysez l'impact concret pour vos agents IA d'entreprise.
Mistral Small 4 arrive en MoE 119B Apache 2.0 avec 256k de contexte. Voici ce qu'un DSI français peut en faire dès demain matin.
Mistral distribue Le Chat Enterprise sur AWS, Azure et GCP en avril 2026. Première alternative souveraine crédible à Copilot pour les ETI françaises.
DeepSeek V4 arrive fin avril 2026 : 1 000 milliards de paramètres, contexte 1M tokens, natif Huawei Ascend. Ce que les DSI français doivent arbitrer.
GPT-6 est officiellement sorti sous le nom Astra le 3 septembre 2026. Analyse des faits post-sortie et de la préparation stack IA d'un DSI français.
Z.ai a sorti GLM-5.1 open-source le 7 avril 2026 — #1 sur SWE-Bench Pro, entraîné sans Nvidia. Ce que ça change pour la souveraineté IA européenne.
MiniMax, DeepSeek et Kimi trustent 61% des tokens sur OpenRouter en 2026. Analysez l'impact sur votre stratégie LLM d'entreprise.
Google lance Gemma 4 sous Apache 2.0 avec 256K tokens et function calling natif. Analysez l'impact pour vos agents IA d'entreprise.
Meta lance Muse Spark, son premier modèle propriétaire, et repositionne Llama 5 sur l'agentic. L'Europe perd son dernier GAFAM ouvert. Analyse.
Analysez comment les LLM chinois open-weight dépassent GPT-5.4 sur les benchmarks et ce que ça implique pour votre stratégie IA multi-modèles.
Analysez pourquoi Meta abandonne l'open source avec Muse Spark et ce que ça change pour les ETI françaises qui utilisaient Llama.
Découvrez Voxtral TTS, le modèle text-to-speech de Mistral AI qui bat ElevenLabs et ouvre la voie aux callbots souverains.
Analysez la chute de 80% des prix API des LLM en 2026 et son impact concret sur les projets chatbot et agents IA des entreprises françaises.
Un expert Webotit analyse vos flux, identifie les quick-wins et vous propose une feuille de route personnalisée.
Créneau sélectionné
mardi 29 septembre
Heure
Disponibilités estimées. La validation finale et la disponibilité en temps réel se font dans TidyCal.