VJOURNAL

IA • Rubrique mondiale • 01 octobre 2026

Gemini 4 Argon arrive avec un million de jetons en sortie et un accès progressif

Argon offre surtout davantage de place aux travaux prolongés. Ses scores de programmation et de vidéo demandent de regarder la méthodologie et les conditions d’accès.

Couverture VJOURNAL pour « Gemini 4 Argon arrive avec un million de jetons en sortie et un accès progressif »

Réponse en bref

Argon offre surtout davantage de place aux travaux prolongés. Ses scores de programmation et de vidéo demandent de regarder la méthodologie et les conditions d’accès.

Arrêt des vérifications: 4 sources
Google a annoncé Argon le 30 septembre avec jusqu’à un million de jetons en sortie.
Le tableau combine évaluations internes et résultats externes ; les quotas d’images vidéo diffèrent.
L’accès commence par les cyberdéfenseurs de confiance ; une ouverture plus large reste prévue.

Davantage de place pour les travaux prolongés

Le lancement de Gemini du 30 septembre vise le travail professionnel qui se déroule en nombreuses étapes. Google annonce jusqu’à un million de jetons en sortie pour Gemini 4 Argon, contre un plafond précédent de 64.000. Pour les développeurs, cela augmente la place disponible pour raisonner et produire du matériel dans une même trajectoire.

Il faut distinguer le contexte reçu et la marge de sortie. Une fois le dépôt fourni, l’agent doit encore examiner les fichiers, revoir son plan et préparer les modifications. L’annonce décrit davantage d’espace pour ce processus. Une migration utile ou un rapport vérifiable se juge cependant sur le livrable obtenu et sur les contrôles qui permettront de l’accepter.

Les résultats de code varient selon l’épreuve

Le tableau de Google DeepMind, vérifié le 1er octobre, donne 77,9 % à Argon sur DeepSWE v1.1. La méthodologie précise l’usage de mini-swe-agent pour Argon, alors que les comparaisons proviennent de classements et de fiches système au meilleur niveau de raisonnement déclaré. FrontierSWE v2 montre une autre configuration de résultats. Chaque ligne aide à choisir les tâches à examiner.

Dans une migration, le critère compte : préserver un comportement, produire une correction acceptable ou dessiner une interface séduisante sont des objectifs différents. Additionner ces pourcentages effacerait ce qui rend chaque épreuve informative. Les sources ne définissent pas une échelle globale permettant de désigner un champion de tous les travaux.

Tableau Google DeepMind annoncé le 30 sep 2026, vérifié le 1er oct ; méthodologie : résultats à octobre, dates exactes inconnues. Compilation du fournisseur, pas un essai indépendant uniforme.
MesureGemini 4 ArgonGPT-6 AstraClaude Opus 5.5Conditions d’évaluation
DeepSWE v1.1 (%)77.9%74.1%74.2%Sources diverses ; meilleur niveau déclaré
FrontierSWE v2 (%)55.0%65.5%62.3%Sources diverses ; meilleur niveau déclaré
LVBench (%)91.7%87.5%83.7%Sans outils ; quotas d’images différents

La vidéo comporte une réserve sur les images

Le même tableau inclut LVBench. Google indique des essais sans outils, mais présente à Gemini une image par seconde et autorise 800 images pour Astra, 600 pour Opus, à cause des limites des API. Cette différence dans le matériel disponible reste significative, même si tous les modèles sont associés au même nom de test.

Pour vérifier une démonstration de produit ou une procédure enregistrée, il faut retrouver le moment pertinent et relier l’explication à une preuve visible. L’échantillonnage peut éliminer ce moment avant même le raisonnement. Un pourcentage élevé doit donc conduire à essayer la durée réelle des vidéos et la préparation des images qui seront utilisées dans l’application.

Le tarif initial accompagne un accès restreint

Google annonce $2 par million de jetons en entrée et $10 en sortie pendant la période initiale, puis $4 et $20. Sa date de fin n’est pas précisée. Le premier déploiement passe par Fairwind pour des cyberdéfenseurs de confiance ; une diffusion aux développeurs, entreprises et consommateurs est prévue.

Les clients payants de l’API et les abonnés Google AI Ultra sont présentés comme premiers groupes de cette ouverture. Cela ne confirme pas l’accès de chaque abonné aujourd’hui. En comparaison, la fiche officielle d’Astra documente une sortie maximale de 128.000 jetons. Capacité, prix et disponibilité doivent être vérifiés séparément avant d’annoncer une échéance de projet.

Suivre le lancement par les livrables terminés

La direction annoncée favorise les processus professionnels prolongés. Notre interprétation éditoriale est que la marge supplémentaire compte lorsque l’agent progresse, conserve les preuves et termine par un résultat contrôlable. Une génération plus longue ne démontre pas à elle seule l’achèvement réussi d’un travail d’ingénierie ou de recherche documentaire.

Un premier essai utile garderait un dépôt ou un ensemble de vidéos connus, une définition écrite du succès et le journal complet des actions. Il compterait les livrables acceptés, le temps et les jetons. Au 1er octobre, l’annonce et les évaluations sont actuelles ; l’ouverture générale, le calendrier tarifaire et les performances sur le travail du lecteur restent à vérifier.

Questions et réponses

Que signifie la limite d’un million ?

Google décrit une sortie maximale, portée de 64.000 à un million de jetons. Cela ne fixe pas la longueur de chaque réponse et ne mesure pas son exactitude indépendamment.

Le test vidéo est-il entièrement uniforme ?

Google exécute LVBench sans outils, mais accorde des nombres d’images différents à cause des contraintes des API. Les pourcentages doivent être lus avec cette réserve.

Quand Argon sera-t-il accessible au public ?

Google prévoit de commencer l’ouverture par les clients payants de l’API et Google AI Ultra. L’annonce ne fournit pas de date générale de disponibilité confirmée.