Vad Google faktiskt lanserade den 1 september

Google lade den 1 september 2026 till agentisk videoförståelse i tre modeller i sin Gemini Flash-serie: Gemini 3.7 Flash, 3.6 Flash och 3.5 Flash-Lite, enligt Googles eget tillkännagivande och oberoende rapportering från Android Authority. Funktionen är en bearbetningsteknik, inte en ny modell eller en ny produktlinje, och den bör inte förväxlas med Gemini 3.8 Flash, en separat modell som Google lanserade en dag senare, den 2 september, med egna pris- och lanseringstaktfrågor som redan täckts på annat håll. Agentisk videoförståelse förändrar hur dessa tre Flash-modeller läser video, medan de underliggande modellvikterna och deras befintliga förmågor förblir oförändrade.

Hur modellen bestämmer vad den tittar på

Mekanismen ersätter skanning med fast bildfrekvens med en modell som, segment för segment, avgör vad den ska granska, hur snabbt den ska röra sig och vilken modalitet den ska använda. Äldre metoder för videoförståelse samplar en video med ett fast antal bilder per sekund oavsett innehåll, så att en statisk tvåtimmars säkerhetsinspelning får samma bild-för-bild-behandling som två minuter snabb handling. Googles agentiska metod söker i stället i videon efter de segment som spelar roll och granskar bara dem, och växlar mellan bilder, ljud och transkript beroende på vad frågan kräver. Just den riktade sökningen är det som möjliggör återfinning av ögonblick på bråkdelen av en sekund i långa och timslånga videor, upptäckt av visuella avvikelser eller artefakter, samt räkning av objekt eller händelser genom ett klipp, uppgifter som enhetlig bildsampling hanterar betydligt mindre effektivt.

Siffrorna, jämförda

Google publicerar tre huvudsiffror för det nya bearbetningsläget, och ingen av dem beskriver en ny prisnivå.

MätvärdeGoogles uppgift
TokenförbrukningUpp till 88% lägre
BearbetningskostnadUpp till 66% lägre
Kvalitet/precisionUpp till 7% högre

Alla tre siffror kommer från Googles egna tester och gäller till Gemini-API:ets standardpriser för tokens; det tillkommer ingen extra avgift för att slå på det agentiska läget. Utvecklare aktiverar det genom att sätta API:ets processing-parameter till agentic, redan tillgängligt i Google AI Studio och Gemini Enterprise Agent Platform.

Varför detta är en historia om arbetsbelastningsekonomi, inte om priser

För team i EU och Storbritannien som kör videotunga AI-arbetsbelastningar avgör en minskning på 88% i tokenförbrukning om storskalig videoanalys överhuvudtaget är prisvärd i produktionsskala, inte bara vad en enskild förfrågan kostar. Det är en annan historia än Gemini 3.8 Flashs separata pris- och taktändringar: Google buntar här ihop en effektivitetsteknik i den befintliga Flash-serien utan extra avgift, i stället för att sälja en ny nivå. Före den 1 september var det, i många videoanalysprojekt, löpande bevakning av säkerhetskameror, timslång inspelningsgenomgång för innehållsmoderering, medieövervakning över sändningsarkiv, kvalitetskontroll av reklamvideor över ett helt bibliotek, ofta tokenkostnaden för bild-för-bild-inläsning som var det verkliga hindret, inte en gräns för modellens förmåga. En minskning på 88% av den inläsningskostnaden flyttar flera av dessa användningsfall från en post som stryks vid en budgetgenomgång till en som ett team faktiskt kan köra löpande.

Servola Journal

Vi gör detta för alla som försöker hålla jämna steg med vad tekniken gör med våra liv. Människorna som bygger den, och människorna det händer med. Servola Journal finns så att det vi lär oss tillhör dem alla.

Ingen betalar oss för detta. Inga annonser, ingen betalvägg, gratis för alla. Vi tror helt enkelt att förståelse av vad som händer oss alla inte borde bero på vem som har råd att betala för det.

Om det gav dig något idag, säg till oss att fortsätta. Följ oss, lämna en gilla-markering, eller skriv en positiv kommentar. Vi läser varenda en, och de är det som håller oss igång.