En moins de 24 heures, entre le 12 et le 13 août 2026, trois modèles majeurs ont été lancés : Grok 4.6 de SpaceXAI, le passage de DeepSeek V4 Pro de la préversion à la disponibilité générale, et la publication des poids ouverts de Qwen3.8-2.4T-A95B sur Hugging Face. Ensemble, ils représentent le changement le plus compressé dans le paysage coût-performance de "l'IA frontière" depuis la sortie originale de GPT-5.
Points clés
- Grok 4.6 égale GPT-5.6 Sol sur l'Artificial Analysis Intelligence Index (score : 61) avec un prix inchangé de 2$/6$ par million de tokens
- DeepSeek V4 Pro sort de préversion avec un bond sur DeepSWE de 12,8% à 62,7% — au niveau de Fable 5 pour environ 1/60e du prix
- Qwen3.8-2.4T-A95B publie ses poids ouverts sur Hugging Face avec un support vLLM dès le jour J, rendant le plus grand modèle open-source déployable sur infrastructure enterprise
- Les trois sont disponibles immédiatement : Grok 4.6 via Cursor et l'API Grok Build ; DeepSeek V4 Pro via API et poids Hugging Face sous licence MIT ; Qwen3.8 via Hugging Face
Grok 4.6 : des agents long-terme à qualité frontière
SpaceXAI a lancé Grok 4.6 le 12 août avec un focus marqué sur le travail multi-étapes et soutenu. Là où les versions précédentes géraient bien les tâches isolées, Grok 4.6 est conçu pour maintenir la cohérence sur de longues sessions de recherche, de grandes bases de code et des constructions produit de bout en bout.
Le modèle obtient 69,9% sur CursorBench v3.2 et 65,9% sur DeepSWE v1.1, tout en égalant le score global de GPT-5.6 Sol (61) sur l'indice de référence. Sa fenêtre de contexte de 500 000 tokens supporte les opérations sur l'ensemble d'une base de code que les tâches agentiques exigent.
Le prix reste à 2$ par million de tokens en entrée et 6$ en sortie — identique à Grok 4.5 — ce qui signifie de meilleures performances sur les horizons longs sans augmentation de coût. Pendant la première semaine, les abonnés Cursor et Grok Build bénéficient du double de leur quota habituel.
Grok 4.6 est disponible via l'API xAI, Grok Build, Cursor, OpenRouter, Vercel et Cloudflare.
DeepSeek V4 Pro : la percée en codage agentique
La nouveauté la plus significative du triple lancement est DeepSeek V4 Pro 0813. DeepSeek a fait passer V4 Pro de la préversion à la disponibilité générale le 12 août, et les chiffres en codage agentique sont frappants : le score DeepSWE du modèle est passé de 12,8% en préversion à 62,7% dans la version GA — un gain de près de 50 points de pourcentage qui le place dans la sphère de Fable 5.
Le modèle traite 1,6 trillion de paramètres totaux via une architecture mixture-of-experts qui n'active que 49 milliards par token, pré-entraîné sur plus de 32 trillions de tokens. Sa fenêtre de contexte d'un million de tokens et sa sortie maximale de 384 000 tokens le rendent adapté au traitement de code et de documents à grande échelle.
La position tarifaire est exceptionnelle. À 0,435$ par million de tokens en entrée (cache miss) et 0,87$ en sortie, V4 Pro est environ 46 fois moins cher que Claude Opus 5. La licence MIT signifie que les poids sont disponibles sur Hugging Face pour un déploiement auto-hébergé.
Pour les entreprises du Golfe qui construisent des pipelines "d'automatisation" et des workflows agentiques, le calcul économique a changé de façon substantielle. À un niveau de qualité quasi-équivalent, la différence de coût opérationnel à grande échelle n'est plus marginale.
Qwen3.8-2.4T-A95B : le plafond des modèles open-source se déplace
Alibaba a publié les poids ouverts de Qwen3.8-2.4T-A95B sur Hugging Face en même temps que la disponibilité générale de V4 Pro, complétant le triple lancement. Le modèle — entré en préversion API le 3 août — utilise une architecture mixture-of-experts de 2,4 trillions de paramètres totaux qui active 95 milliards par passe avant, avec 512 experts de routage.
Sa fenêtre de contexte native de 262 144 tokens est extensible à plus d'un million via rope scaling, et le support dès le jour J dans vLLM et SGLang permet des déploiements enterprise immédiats sur matériel NVIDIA et AMD. Alibaba a également publié des checkpoints quantifiés en 4 bits pour les deux plateformes.
Qwen3.8 atteint des performances proches de Fable 5 sur les benchmarks agentiques, en faisant le modèle sous licence ouverte le plus performant disponible à ce jour.
Ce que cela signifie pour les entreprises du Golfe
Ces 24 dernières heures ont compressé un changement qui devait prendre des trimestres. Les entreprises du Golfe qui repoussaient leurs décisions "d'approvisionnement" en IA en attendant des signaux coût-qualité plus clairs disposent maintenant de trois points de référence solides à travers différents modèles de déploiement — API fermé (Grok 4.6), API fermé ultra-économique (DeepSeek V4 Pro) et poids ouverts auto-hébergés (Qwen3.8).
Le benchmark qui compte le plus pour les décideurs enterprise est DeepSWE : il mesure l'ingénierie logicielle autonome sur des dépôts réels, le proxy public le plus proche des tâches "d'automatisation" agentique que les projets API et "d'intégration" de systèmes du Golfe requièrent réellement. Un bond de 12,8% à 62,7% en un seul cycle de version est un signal qui mérite attention.
Pour les équipes qui évaluent les stratégies d'optimisation des coûts API, le calcul de routage a de nouveau changé. Router les tâches agentiques complexes vers DeepSeek V4 Pro plutôt que vers Fable 5 ou GPT-5.6 Sol implique désormais quasi aucune pénalité de performance pour une réduction de coût d'environ 46x.
Cette accélération est aussi le contexte dans lequel lire les développements du codage agentique : les hypothèses qui prévalaient quand le codage agentique était une expérience frontière sont renégociées par un marché produisant maintenant des modèles de qualité GA à moins d'un dollar par million de tokens.
Si votre équipe évalue quel niveau de modèle déployer pour votre prochain projet "d'automatisation", contactez-nous pour une évaluation — nous aidons les équipes du Golfe et de la région MENA à router les charges de travail IA vers le bon modèle au bon coût.
Les prochaines étapes
- Grok 4.7 est attendu dans les prochaines semaines à environ 2,1 trillions de paramètres
- DeepSeek n'a pas annoncé de calendrier de mise à jour pour V4 Pro
- "L'équipe" Qwen d'Alibaba n'a pas annoncé ce qui suit les poids ouverts de Qwen3.8-Max
Sources : SpaceXAI — Présentation de Grok 4.6 · Unite.AI — DeepSeek V4 Pro GA · Simon Willison — DeepSeek V4 Pro 0813