Ce que Google a réellement lancé le 1er septembre
Google a ajouté la compréhension vidéo agentique à trois modèles de sa gamme Gemini Flash le 1er septembre 2026 : Gemini 3.7 Flash, 3.6 Flash et 3.5 Flash-Lite, selon l'annonce officielle de Google et la couverture indépendante d'Android Authority. La fonction est une technique de traitement, pas un nouveau modèle ni une nouvelle gamme de produits, et elle ne doit pas être confondue avec Gemini 3.8 Flash, un modèle distinct que Google a lancé un jour plus tard, le 2 septembre, avec ses propres questions de prix et de rythme de sortie déjà traitées ailleurs. La compréhension vidéo agentique change la façon dont ces trois modèles Flash lisent la vidéo, tandis que les poids du modèle sous-jacent et ses capacités existantes restent inchangés.
Comment le modèle décide quoi regarder
Le mécanisme remplace le balayage à fréquence d'images fixe par un modèle qui décide, segment par segment, quoi inspecter, à quelle vitesse avancer et quelle modalité utiliser. Les approches précédentes de compréhension vidéo échantillonnent une vidéo à un nombre fixe d'images par seconde quel que soit le contenu, si bien qu'un enregistrement de sécurité statique de deux heures reçoit le même traitement image par image que deux minutes d'action rapide. L'approche agentique de Google recherche au contraire dans la vidéo les segments qui comptent et n'inspecte que ceux-là, en alternant entre images, audio et transcriptions selon ce que la question exige. C'est cette recherche ciblée qui permet la récupération de moments à la fraction de seconde près dans des vidéos longues et de plusieurs heures, la détection d'anomalies ou d'artefacts visuels, et le comptage d'objets ou d'actions sur un extrait, des tâches qu'un échantillonnage uniforme des images traite bien moins efficacement.
Les chiffres, comparés
Google publie trois chiffres principaux pour ce nouveau mode de traitement, et aucun d'eux ne décrit un nouveau palier tarifaire.
| Indicateur | Chiffre annoncé par Google |
|---|---|
| Consommation de jetons | Jusqu'à 88% en moins |
| Coût de traitement | Jusqu'à 66% en moins |
| Qualité/précision | Jusqu'à 7% en plus |
Les trois chiffres proviennent des propres tests de Google et s'appliquent au tarif standard des jetons de l'API Gemini, sans frais supplémentaire pour activer le mode agentique. Les développeurs l'activent en réglant le paramètre processing de l'API sur agentic, déjà disponible dans Google AI Studio et la Gemini Enterprise Agent Platform.
Pourquoi c'est une histoire d'économie de charge de travail, pas de tarifs
Pour les équipes de l'UE et du Royaume-Uni qui font tourner des charges de travail IA gourmandes en vidéo, une réduction de 88% de la consommation de jetons change si l'analyse vidéo à grande échelle est même envisageable en production, pas seulement le coût d'une requête isolée. C'est une histoire distincte des changements de prix et de rythme propres à Gemini 3.8 Flash : Google regroupe ici une technique d'efficacité dans la gamme Flash existante sans frais supplémentaire, plutôt que de vendre un nouveau palier. Avant le 1er septembre, sur de nombreux projets d'analyse vidéo, surveillance continue de caméras de sécurité, tri de plusieurs heures d'images pour la modération de contenu, veille médiatique sur des archives de diffusion, contrôle qualité de vidéos publicitaires sur toute une bibliothèque, le véritable obstacle était souvent le coût en jetons de l'ingestion image par image, pas une limite de capacité du modèle. Une réduction de 88% de ce coût d'ingestion fait passer plusieurs de ces cas d'usage d'une ligne budgétaire supprimée en révision à une charge qu'une équipe peut réellement faire tourner en continu.
Servola Journal
Nous faisons cela pour tous ceux qui essaient de suivre ce que la technologie fait à nos vies. Les personnes qui la construisent, et les personnes à qui cela arrive. Le Servola Journal existe pour que ce que nous apprenons appartienne à tous.
Personne ne nous paie pour cela. Pas de publicité, pas de mur payant, gratuit pour tous. Nous croyons simplement que comprendre ce qui nous arrive à tous ne devrait pas dépendre de qui peut se permettre de payer pour cela.
Si cela vous a apporté quelque chose aujourd'hui, dites-le-nous pour que nous continuions. Suivez-nous, laissez un like, ou écrivez un commentaire positif. Nous les lisons tous, et ce sont eux qui nous font continuer.
À lire ensuite: L'option sans filigrane de Google teste l'AI Act | Google Assistant s'arrête le 4 septembre pour Gemini



