Gemini 3.5 Pro : aucune date de sortie, inutile d’attendre

Gemini 3.5 Pro n’a toujours aucune date de sortie. Voici pourquoi son retard ne doit bloquer ni vos projets, ni vos migrations, ni vos achats.

Thursday, September 3, 2026Omid Saffari
Gemini 3.5 Pro : aucune date de sortie, inutile d’attendre

Gemini 3.5 Pro n’a toujours aucune date de sortie publique. Google avait annoncé son arrivée en juin ; le 16 juillet, Reuters a révélé que le modèle accusait plusieurs mois de retard, faute de performances suffisantes en programmation. Pour l’instant, ne fondez dessus ni feuille de route produit, ni migration, ni décision d’achat.

Gemini 3.5 Pro : aucune date de sortie annoncée

Gemini 3.5 Pro est toujours en phase de test, et Google n’a communiqué aucune nouvelle date publique après avoir manqué l’échéance de juin. Le catalogue de modèles en ligne de l’entreprise répertorie Gemini 3.5 Flash et Gemini 3.1 Pro Preview. Sa page tarifaire, elle, ne mentionne pour 3.5 Pro ni entrée dédiée, ni identifiant de modèle API, ni prix, ni conditions d’accès gratuit, ni limite de contexte, ni tableau de benchmarks.

Les rumeurs d’un lancement le 17 juillet ne permettent donc pas de planifier quoi que ce soit. Une date ne devient crédible que lorsque Google publie le modèle, son mode d’accès et ses conditions commerciales — pas lorsqu’une source anonyme ou une page de compte à rebours la répète.

Page d’annonce officielle de Gemini 3.5 par Google
Gemini 3.5

Les faits confirmés tiennent en quelques lignes :

DateÉvénementCe qu’il faut en retenir
19 mai 2026Google présente Gemini 3.5, lance 3.5 Flash et annonce que 3.5 Pro arrivera « le mois suivant »La fenêtre publique était fixée à juin 2026
Juin 2026L’échéance annoncée passe sans lancement public de 3.5 ProLe calendrier a dérapé
Fin juin 2026D’après les informations rapportées, Google actualise les données d’entraînement de Gemini pour améliorer ses capacités en programmation, sans obtenir les résultats attendusLe problème signalé tient à la qualité du modèle, pas à son packaging
16 juillet 2026Reuters rapporte que 3.5 Pro accuse plusieurs mois de retardUne sortie imminente ne peut plus être considérée comme acquise
17 juillet 2026Le catalogue public et la page tarifaire de Google ne mentionnent toujours pas 3.5 ProRien de concret à acheter, à intégrer ou à soumettre à des benchmarks

La déclaration de Google est soigneusement pesée. Un porte-parole indique que l’entreprise teste 3.5 Pro, une version améliorée de Flash et d’autres modèles avec des partenaires. Le développement est donc bien actif, mais cela ne confirme ni semaine de lancement, ni fonctionnalités, ni prix.

Chronologie de l’annonce de mai au retard signalé en juillet, après l’échéance manquée de juin
L’échéance officielle de juin est passée ; aucune nouvelle date n’a été rendue publique.

Pourquoi les performances en programmation peuvent retarder un modèle phare

La programmation peut retarder un modèle phare parce que le vrai défi ne consiste plus à générer une fonction bien écrite. Il faut rester fiable pendant qu’un agent parcourt un dépôt, choisit ses outils, modifie plusieurs fichiers, exécute des tests, détecte un échec puis se rétablit sans dégrader la base de code.

C’est ce qu’on appelle la programmation agentique : un travail logiciel soutenu, réparti sur de nombreuses étapes, de nombreux outils et autant de décisions. Un modèle peut impressionner lors d’une démonstration en un seul prompt, puis échouer lorsque la vingtième action dépend de la justesse des dix-neuf premières. Un plan fragile ou une dépendance inventée suffit à effacer tous les gains de vitesse précédents.

Au sein même de la gamme Google, la barre est déjà difficile à franchir pour un nouveau modèle Pro. Google présente Gemini 3.5 Flash, déjà disponible, comme son meilleur modèle pour la programmation et les tâches agentiques, avec les résultats suivants :

BenchmarkCe qu’il évalueGemini 3.5 Flash
Terminal-Bench 2.1Réalisation de tâches concrètes dans un terminal76.2%
GDPval-AATâches expertes à valeur économique1656 Elo
MCP AtlasWorkflows en plusieurs étapes avec des outils connectés83.6%
CharXiv ReasoningCompréhension de contenus visuels et techniques complexes84.2%

Google affirme également que 3.5 Flash génère ses tokens de sortie quatre fois plus vite que les autres modèles de pointe. Ces résultats sont publiés par le fournisseur, sans validation indépendante, mais ils mettent en lumière la difficulté produit : un modèle phare baptisé Pro ne peut pas se contenter d’être plus gros. Il doit surpasser le modèle rapide sur les tâches coûteuses que les clients réservent à un modèle phare, tout en restant assez fiable pour de longues séquences agentiques.

Reuters, citant Bloomberg, rapporte que Google a actualisé les données d’entraînement fin juin afin d’améliorer la programmation, mais que les résultats n’ont pas répondu aux attentes. Cela ne prouve ni refonte complète, ni nouvelle architecture, ni taille de fenêtre contextuelle évoquée par les rumeurs. Le seul fait établi est que, d’après ces informations, le niveau de qualité attendu n’a pas été atteint dans le calendrier prévu.

Pour le CTO d’une entreprise de taille intermédiaire, cette nuance compte davantage que le retard lui-même. Un modèle en retard est gênant. Un modèle dont le comportement varie au fil d’une longue tâche de programmation peut alourdir les revues, créer des risques de sécurité et imposer des retours arrière dont le coût dépasse largement la facture API.

Quel modèle utiliser dès maintenant ?

Choisissez Gemini 3.5 Flash pour livrer, programmer et enchaîner les boucles agentiques. Réservez Gemini 3.1 Pro Preview aux cas où un raisonnement plus poussé justifie une latence supérieure et une facture de tokens plus élevée. Attendre 3.5 Pro n’est pas le bon choix par défaut : les deux solutions disponibles offrent déjà un accès public et des coûts mesurables.

La gamme Gemini 3 dans son ensemble évolue vite, mais la décision est aujourd’hui simple :

CritèreGemini 3.5 FlashGemini 3.1 Pro PreviewGemini 3.5 Pro
Statut publicDisponibilité généralePreviewNon répertorié publiquement
Meilleur usage actuelProgrammation, agents, gros volumes, faible latenceRaisonnement poussé et résolution de problèmes complexesAucun usage planifiable à ce stade
Identifiant de modèle APIgemini-3.5-flashgemini-3.1-pro-previewNon publié
Tarif standard en entrée$1.50 par 1 million de tokens$2.00 jusqu’à 200,000 tokens inclus ; $4.00 au-delàNon publié
Tarif standard en sortie$9.00 par 1 million de tokens$12.00 jusqu’à 200,000 tokens inclus ; $18.00 au-delàNon publié
Accès API gratuitOuiNonNon publié
Principal compromisRapidité ne signifie pas infaillibilitéStatut Preview et coût supérieurNi date, ni conditions, ni preuves

L’écart tarifaire apparaît clairement sur une charge de travail agentique ordinaire, calculée avec les tarifs API actuels de Google. Un million de tokens en entrée et 200,000 tokens en sortie coûtent $3.30 avec 3.5 Flash au tarif Standard. La même charge agrégée revient à $4.40 avec 3.1 Pro Preview si chaque prompt reste inférieur ou égal à 200,000 tokens. Dans cet exemple, Flash coûte 25% moins cher, avant même de tenir compte de son avantage en latence.

La gamme actuellement disponible chez Google permet déjà d’importants traitements en arrière-plan. Gemini Managed Agents peut exécuter des tâches en plusieurs étapes dans des environnements distants : une équipe n’a donc pas besoin de geler son pilote agentique dans l’attente d’un futur modèle phare.

Arbre de décision orientant les tâches rapides et agentiques vers Gemini 3.5 Flash, et le raisonnement poussé vers Gemini 3.1 Pro
Livrez avec le modèle adapté à la tâche ; gardez 3.5 Pro derrière une condition de lancement.
  1. Établir une référence avec 3.5 Flash

    Mesurez le taux de réussite, le temps de revue, la latence et le coût sur le modèle disponible en production. Une annonce de lancement ne remplacera jamais vos propres critères d’acceptation.

  2. Créer une seule voie d’escalade vers Pro

    N’envoyez à 3.1 Pro Preview que les échecs dus à un raisonnement insuffisamment poussé. Laissez le reste sur Flash afin de voir si la dépense supplémentaire produit réellement un meilleur résultat.

  3. Garder l’identifiant du modèle configurable

    Stockez le nom du modèle dans la configuration au lieu de le coder en dur dans l’application. Vous pourrez ainsi évaluer un futur 3.5 Pro dans un test maîtrisé, sans réécriture.

  4. Réexaminer le choix après le lancement

    Ne comparez 3.5 Pro au même jeu de tâches qu’après la publication par Google de l’accès, des tarifs, des limites et des benchmarks. Adoptez-le pour un gain mesuré, pas pour son étiquette Pro.

Les cinq preuves à exiger avant d’adopter 3.5 Pro

Gemini 3.5 Pro méritera une évaluation lorsque cinq informations publiques seront disponibles simultanément. Une annonce de lancement ne suffit pas.

  1. Un identifiant de modèle API officiel. Il prouve que les développeurs peuvent appeler le véritable modèle via une interface documentée, et non par une preview privée réservée à des partenaires ou par l’intermédiaire d’un service tiers.
  2. Une grille tarifaire complète. Les tarifs des tokens d’entrée et de sortie, du cache, du traitement par lots, du grounding et des longs prompts déterminent si un avantage aux benchmarks reste viable en production.
  3. Des limites de fonctionnement publiées. Taille du contexte, limites de sortie, entrées prises en charge, régions, quotas et conditions de traitement des données permettent de vérifier que le modèle s’intègre au système qui l’entoure.
  4. Des benchmarks comparables. La vraie question n’est pas de savoir si 3.5 Pro obtient un bon score, mais s’il surpasse 3.5 Flash et 3.1 Pro précisément sur les types d’échecs qui font perdre du temps à votre équipe.
  5. Un statut de disponibilité stable. Une Preview convient aux expérimentations dotées de solutions de repli. La disponibilité générale constitue une base plus solide pour une dépendance exposée aux clients.

Ces garde-fous évitent deux erreurs coûteuses. La première consiste à suspendre un travail utile dans l’attente d’une capacité future dont l’économie reste inconnue. La seconde, à migrer dès le lancement avant de découvrir que le nouveau modèle phare est plus lent, plus cher ou à peine meilleur sur votre charge de travail.

Qui doit attendre, et qui doit avancer maintenant ?

La plupart des équipes ont intérêt à avancer dès maintenant, à condition d’adopter une architecture indépendante du modèle.

ProfilMeilleure décision aujourd’huiPourquoi
Fondateur financé qui lance un produit agentiqueConstruire sur 3.5 Flash avec une couche de modèle configurableLe time-to-market compte, et le modèle disponible en production cible déjà les tâches agentiques
CTO d’une entreprise de taille intermédiaire qui standardise l’IA en internePiloter Flash pour le volume et 3.1 Pro Preview pour les exceptions difficilesCette approche établit une vraie politique de routage et une référence de coût avant l’arrivée de 3.5 Pro
Professionnel expérimenté qui automatise la recherche ou le reportingUtiliser le modèle disponible qui satisfait un test d’acceptation contrôlé par un humainUn calendrier manqué ne doit pas bloquer un workflow réversible
Développeur indépendantPrototyper avec l’accès gratuit à 3.5 Flash, puis chiffrer le passage à l’offre payanteLa preuve utile la moins chère vaut mieux que l’attente d’un prix inconnu
Équipe dont aucun modèle actuel ne sait accomplir la tâche de manière fiableAttendre, mais ne geler que cette expérimentationRien ne prouve encore que 3.5 Pro résoudra cet échec précis

Les acheteurs intéressés par la programmation devraient aussi regarder au-delà de la famille Gemini. Le classement actuel des modèles de programmation offre un meilleur cadre de comparaison lorsque le travail à l’échelle d’un dépôt compte davantage que le maintien dans l’écosystème Google.

La seule raison défendable d’attendre est très précise : votre projet répond à une exigence documentée que Flash et 3.1 Pro ne peuvent satisfaire, et son report coûte moins cher que le choix d’un autre fournisseur. Même dans ce cas, considérez 3.5 Pro comme un futur candidat parmi d’autres, pas comme la réponse par défaut.

Gemini 3.5 Pro est-il retardé ?

Oui. Le 19 mai, Google annonçait le déploiement de 3.5 Pro pour le mois suivant. Le 16 juillet, Reuters a rapporté que le modèle accusait plusieurs mois de retard, ses performances en programmation n’ayant pas atteint les attentes internes.

Gemini 3.5 est-il déjà disponible ?

Gemini 3.5 Flash est disponible de façon générale via l’API Gemini et les produits Google. Gemini 3.5 Pro ne figure publiquement ni dans le catalogue de modèles ni sur la page tarifaire de Google.

Gemini 3.5 Flash est-il meilleur que 3.1 Pro ?

Flash constitue le meilleur choix par défaut pour la vitesse, le coût, la programmation et les boucles agentiques répétées. Google publie un résultat de 76.2% pour 3.5 Flash sur Terminal-Bench 2.1, tandis que son tableau de benchmarks de 3.1 Pro indique 68.5% sur Terminal-Bench 2.0 : les versions différentes empêchent donc toute comparaison directe et rigoureuse. Utilisez 3.1 Pro Preview lorsque le raisonnement plus poussé améliore réellement votre tâche, pas simplement parce que Pro paraît plus puissant.

Gemini 3.5 Pro est-il gratuit ?

Aucun tarif public ni aucune condition d’accès gratuit n’existent pour 3.5 Pro. Les promesses de gratuité ne reposent sur aucun tarif publié par Google. Gemini 3.5 Flash propose actuellement un accès API gratuit ; Gemini 3.1 Pro Preview, non.

Recevez la prochaine note d’aide à la décision dès que les faits évoluent.

Dernière mise à jour

3 sept. 2026

CatégorieAI

Préférez ce site dans Google

Ajouter omidsaffari.com comme source préférée dans la recherche Google

Marquez omidsaffari.com comme source préférée et Google le met en avant pour vous dans Top Stories, AI Overviews et AI Mode.

Newsletter

Une lettre, chaque dimanche. Des systèmes qui tournent, pas des hot takes.

Build logs, systèmes en production et notes de terrain d'un portefeuille de ventures IA.

Hebdomadaire. Pas de spam. Désabonnement à tout moment.