Grok 4.6 a codé un jeu de tir 3D en 48 heures, sans intervention humaine

Par: Michael Korgs | aujourd'hui, 14:11
Grok 4.6 a codé un jeu de tir 3D en 48 heures, sans intervention humaine

xAI, la société d'IA d'Elon Musk, a lancé Grok 4.6 le 12 août 2026, en mettant en avant une démonstration spectaculaire : le modèle aurait développé un jeu de tir à la première personne en 3D sur une période de 48 heures, sans aucune intervention humaine. Avec un score de 61 points sur l'Artificial Analysis Intelligence Index — à égalité avec GPT-5.6 Sol d'OpenAI — et un tarif affiché à la moitié du prix des modèles concurrents, Grok 4.6 suscite l'intérêt. Reste à savoir si cette promesse d'autonomie tient à l'examen.

Ce que Grok 4.6 fait vraiment

Le modèle s'appuie sur une technique appelée « Gauntlet Loops » : des cycles itératifs dans lesquels l'agent crée, teste et corrige son propre code sans supervision extérieure. Selon le développeur Matt Shumer, Grok 4.6 a produit un FPS fonctionnel — environnement 3D, déplacements, tir et rechargement — au bout de 48 heures. Une démonstration de 22 minutes publiée séparément montre des fonctionnalités comme les shaders et la minimap, mais sans évaluation indépendante rigoureuse.

Sur les benchmarks composites, Grok 4.6 se place derrière Fable 5 Max mais au niveau de GPT-5.6 Sol, selon Forkast. Nuance importante : sur Terminal-Bench, un test centré sur le code pur, le modèle ne dépasse pas 26 % — bien en dessous de ses concurrents directs. Le score global masque donc un profil de capacités inégal.

Un atout prix, mais des garanties absentes

À 2 dollars par million de tokens en entrée et 6 dollars en sortie, Grok 4.6 coûte deux fois moins cher que les offres frontières d'OpenAI et d'Anthropic, confirme Basenor. Pour les développeurs qui expérimentent via l'API, l'argument tarifaire est réel.

Pour les entreprises françaises, c'est une autre histoire. xAI publie Grok 4.6 pour la deuxième fois consécutive sans model card — le document qui décrit les capacités, les limites et les risques d'un modèle. Sans cette documentation, une évaluation d'impact conforme au RGPD devient très difficile à mener. Des acteurs comme Mistral ou OVHcloud misent précisément sur cette transparence pour séduire le marché professionnel.

Faut-il s'y intéresser ?

Grok 4.6 trace une direction claire : des agents IA capables de mener des projets complexes sur de longues durées, de manière autonome, détaille YourStory. C'est une évolution concrète par rapport aux versions précédentes. Mais tant que xAI ne publie pas de documentation sur le comportement réel du modèle en production, l'adoption reste limitée aux développeurs prêts à tester — pas aux entreprises qui ont des obligations de conformité.