Dixie Consulting — Informations vérifiées le 8 septembre 2026.
Google fait évoluer Gemini avec une nouvelle version orientée vers le code, les agents IA et les tâches complexes. Pour les indépendants et les PME, Gemini 3.8 Flash ouvre de nouvelles pistes d’automatisation. Mais son intérêt se mesurera autant à la qualité du travail terminé qu’à son prix affiché.
Google a présenté Gemini 3.8 Flash le 2 septembre 2026, trois semaines après Gemini 3.7 Flash. Le lancement comprend aussi Gemini 3.8 Flash Cyber, une déclinaison spécialisée dans la cybersécurité. Annonce officielle de Google.
Pour une petite entreprise, la question est concrète : cette nouvelle version peut-elle mieux prendre en charge un travail qui nécessite plusieurs étapes, plusieurs documents ou plusieurs outils ? C’est sur ce terrain que cette sortie mérite d’être examinée.
Une IA conçue pour aller plus loin dans une tâche
Google met en avant trois axes : le développement logiciel sur des tâches longues, les agents capables d’enchaîner des actions et les traitements complexes en entreprise. Gemini 3.8 Flash est disponible en version stable dans l’API, sous l’identifiant gemini-3.8-flash. Documentation des nouveautés.
Un agent IA associe un modèle à des outils et à une logique d’exécution. Il peut, par exemple, consulter des fichiers, effectuer une recherche, lancer un calcul et utiliser le résultat pour poursuivre son travail. Son efficacité dépend donc de sa capacité à garder le fil et à corriger sa démarche.
Imaginons une demande adressée à un assistant de développement : « Comprends pourquoi ce formulaire ne transmet plus les demandes, propose une correction et vérifie qu’elle fonctionne. » Le travail peut nécessiter de lire plusieurs fichiers, d’examiner des erreurs, de modifier le code puis de relancer des contrôles.
Pour une PME, l’intérêt potentiel est de réduire le nombre d’interventions nécessaires pour parvenir à un résultat exploitable. Cela reste à mesurer sur ses propres projets.
Des progrès annoncés, à confronter au terrain
Google rapporte des améliorations sur DeepSWE v1.1, consacré aux problèmes de développement logiciel de longue durée, ainsi que sur des évaluations d’agents en finance et dans le domaine juridique. Ces résultats sont présentés par l’éditeur dans son annonce. Évaluations mises en avant au lancement.
Ils constituent un signal intéressant, mais ne permettent pas de promettre un gain identique sur chaque mission. Un projet ancien, une documentation incomplète ou des règles métier implicites peuvent changer la difficulté du travail.
Pour évaluer un assistant, mieux vaut lui soumettre un problème dont on connaît déjà la solution. On peut alors vérifier s’il identifie la cause, explique correctement son raisonnement utile et produit un résultat sans régression.
Quels usages envisager dans une PME ?
Voici quatre pistes d’expérimentation. Ce sont des scénarios proposés par Dixie Consulting, pas des résultats de tests que nous aurions réalisés avec Gemini 3.8 Flash.
| Besoin | Expérience à mener | Résultat à vérifier |
|---|---|---|
| Maintenance d’un site | Analyser un bug sur une copie de travail et proposer une correction | Fonctionnement rétabli, sans nouvelle erreur |
| Traitement documentaire | Comparer plusieurs documents et préparer une synthèse des écarts | Informations exactes et références faciles à retrouver |
| Analyse commerciale | Examiner un export de ventes et expliquer les variations | Calculs justes et hypothèses clairement signalées |
| Assistance interne | Construire un brouillon de réponse à partir d’une documentation métier | Réponse conforme aux procédures et absence d’invention |
Commencer par un travail récurrent permet de comparer plusieurs versions du modèle sur une base stable. Si une tâche prend habituellement une heure, le critère utile sera le temps restant après génération, relecture et correction.
Un beau rapport obtenu rapidement peut finalement coûter cher s’il exige une longue vérification. À l’inverse, une réponse moins spectaculaire peut être précieuse si elle est juste et immédiatement réutilisable.
Texte, images, audio et documents en entrée
La fiche technique indique que Gemini 3.8 Flash accepte du texte, des images, de la vidéo, de l’audio et des PDF en entrée. Sa sortie est textuelle : ce modèle ne génère pas directement d’images ou d’audio. Il prend en charge jusqu’à 1 048 576 tokens en entrée et 65 536 tokens en sortie. Fiche du modèle.
Cette capacité multimodale permet d’envisager un dossier mêlant, par exemple, des captures d’écran et un document explicatif. La grande fenêtre de contexte offre de la place pour les informations transmises ; elle ne garantit pas que chaque détail sera correctement compris.
Le modèle prend également en charge l’appel de fonctions, l’exécution de code, la recherche dans des fichiers et les sorties structurées. Ces dernières servent notamment à obtenir des données dans un format attendu par un logiciel. Capacités documentées.
Une automatisation devra néanmoins être reliée aux bonnes sources et aux bons outils. Changer de modèle ne suffit pas à lui donner accès au CRM, aux fichiers ou aux procédures de l’entreprise.
Le prix au token reste identique au lancement
Pour l’API en mode Standard, Google affiche les mêmes tarifs de lancement que pour Gemini 3.7 Flash :
| Consommation, par million de tokens | Jusqu’au 31 décembre 2026 | À partir du 1er janvier 2027, tarif annoncé |
|---|---|---|
| Entrée | 0,75 $ | 1,50 $ |
| Sortie, raisonnement inclus | 3,75 $ | 7,50 $ |
Ces montants concernent l’API et doivent être distingués du prix d’un abonnement à l’application Gemini. Les services supplémentaires, comme certaines recherches ou le cache, ont leur propre tarification. Tarifs officiels de l’API Gemini.
Exemple calculé : un million de tokens d’entrée et 200 000 tokens de sortie, raisonnement compris, coûtent 1,50 dollar au tarif de lancement, hors services supplémentaires. À volume identique, ce montant passerait à 3 dollars avec la grille annoncée pour janvier 2027.
Pour budgéter une automatisation durable, il faut donc intégrer la fin du tarif de lancement.
Plus de raisonnement peut signifier plus de consommation
Google précise que Gemini 3.8 Flash peut utiliser davantage de tokens sur les tâches difficiles : il multiplie les étapes de raisonnement, sollicite les outils et vérifie son travail. Trois niveaux d’effort sont disponibles : low, medium et high, avec medium par défaut. Gemini 3.7 Flash reste pris en charge. Fonctionnement du raisonnement et conseils de migration.
À prix unitaire inchangé, une tâche qui mobilise plus de tokens peut coûter davantage. Mais si elle nécessite moins de reprises humaines, son coût total peut aussi devenir plus intéressant.
Nous conseillerions de comparer les niveaux d’effort sur un petit ensemble de demandes représentatives. Le niveau le plus élevé se justifie s’il apporte une amélioration vérifiable. Pour une reformulation simple, il faut surtout rechercher une réponse correcte, rapide et économique.
Comment accéder à Gemini 3.8 Flash ?
Au lancement, Google annonce l’accès pour les abonnés Google AI Pro et Ultra dans l’application Gemini. Les développeurs peuvent l’utiliser via l’API et Google AI Studio, ainsi que dans les outils de développement annoncés, dont Antigravity. L’entreprise mentionne également Gemini Enterprise. Disponibilité annoncée par Google.
Le bon point d’entrée dépend de l’objectif : l’application pour un usage interactif, AI Studio pour expérimenter, puis l’API pour intégrer le modèle à un traitement. Il faut vérifier les conditions et limites du service choisi avant d’étendre l’usage à toute une équipe.
Flash Cyber : une déclinaison à accès contrôlé
Gemini 3.8 Flash Cyber vise la recherche de vulnérabilités et leur correction. Son accès passe par le Fairwind Program, réservé aux partenaires approuvés. Google donne notamment la priorité aux autorités publiques, aux opérateurs d’infrastructures critiques et aux grandes plateformes technologiques. Le modèle peut être utilisé avec CodeMender, son agent de sécurité du code. Présentation du programme Fairwind.
Une PME ne doit donc pas supposer que son abonnement Gemini donne automatiquement accès à cette variante. Pour elle, l’enjeu immédiat reste d’évaluer ce que la version Flash générale apporte à ses travaux quotidiens.
Le regard Dixie Consulting
Gemini 3.8 Flash mérite un essai ciblé si votre usage de l’IA comprend du développement, des dossiers volumineux ou des traitements en plusieurs étapes. Les progrès annoncés correspondent à des besoins concrets : mieux suivre une mission, exploiter les outils disponibles et limiter les reprises.
Notre approche serait de sélectionner cinq à dix tâches réelles, puis de comparer la qualité finale, le temps de contrôle humain et la consommation. On peut ensuite retenir le modèle et le niveau d’effort les plus adaptés à chaque type de travail.
Pour une PME, la valeur de Gemini 3.8 Flash se mesurera au travail fiable qu’il permet de terminer, dans un budget maîtrisé.