Google udvider sin Gemini-portefølje med tre nye modeller: Gemini 3.6 Flash, 3.5 Flash-Lite og 3.5 Flash Cyber. Meldingen er klar: Udviklere, der bygger AI-agenter i produktion, presser på for højere token-effektivitet, lavere latency og mere pålidelig performance, og Flash-serien skal ramme “sweet spot” mellem kvalitet og effektivitet.
Den mest konkrete opgradering er Gemini 3.6 Flash, som ifølge Google bygger direkte på feedback fra udviklere og kunder af 3.5 Flash. 3.6 Flash skal levere et mærkbart løft i kode- og vidensarbejde, samtidig med at modellen bruger færre ressourcer. Google peger bl.a. på Artificial Analysis Index, hvor 3.6 Flash forbruger 17% færre output-tokens end 3.5 Flash. Modellen skal også kunne gennemføre flertrins-workflows med færre “reasoning steps” og færre tool calls.
Effektiviteten bliver koblet til pris. Google oplyser, at 3.6 Flash er billigere end 3.5 Flash med en pris på 1,50 dollar pr. 1 mio. input-tokens og 7,50 dollar pr. 1 mio. output-tokens. Pointen er ikke kosmetisk: Når agentiske workflows kører i skala, er tokenforbrug og svartid direkte lig med driftsomkostninger og brugeroplevelse. Hvis modellen samtidig kan være mindre verbos, kan det reducere både latens og efterfølgende behandling i systemer, der er afhængige af præcise outputs.
Google nævner flere interne eksempler på forbedret performance i forhold til 3.5 Flash, bl.a. ved analyse af finansielle data og transskriptioner samt ved kode-migreringer med multi-agent orkestrering. Udmeldingen kommer også med et kig fremad: Gemini 3.5 Pro testes fortsat med partnere, og Google har sat gang i det, de kalder deres mest ambitiøse pre-training run hidtil for Gemini 4.
Kilde: Google Models & Research.








