Gemini 3.8 Live skal kunne lytte, se og arbejde samtidig

Google opdaterer sin stemme-AI med Gemini 3.8 Live. Modellen skal kunne føre en samtale, bruge værktøjer i baggrunden og skifte mellem 97 sprog.

Gemini 3.8 Live skal kunne lytte, se og arbejde samtidig
Pressefoto: Google.

Google vil have sin stemme-AI til at gøre mere end at vente på næste spørgsmål. Gemini 3.8 Live skal kunne føre samtalen, tage imod live-video, skifte mellem sprog og arbejde videre med værktøjer i baggrunden. Det lyder som en lille opdatering af mikrofonknappen. Det er i praksis et forsøg på at gøre samtalen til brugerfladen.

Den nyttige del er ikke, at stemmen lyder mere menneskelig. Google beskriver en model, der kan slå information op, kalde API’er og aflevere et resultat, mens dialogen fortsætter. Hvis det holder i praksis, kan man forklare et problem højt, vise det med kameraet og lade systemet hente det nødvendige uden at afbryde hver anden sætning.

Det handler om at kunne blive i opgaven

Stemmesamtaler med AI fejler ofte på samme banale måde. Man skal enten tale eller vente. Google prøver at gøre pausen mindre synlig ved at lade modellen arbejde i baggrunden. Den kan for eksempel bruge en ekstern tjeneste, mens du stadig afklarer, hvad du faktisk vil have lavet.

Google fremhæver også visuel input. Det betyder, at en samtale kan tage udgangspunkt i det, kameraet ser, og ikke bare det, du får formuleret. Det er en reel forbedring for fejlfinding, vejledning og små opgaver i hverdagen. Det er samtidig præcis den type funktion, der skal bevise, at den er hurtigere end at åbne en browser og selv finde svaret.

Grafik fra Google om Gemini 3.8 Live
Pressefoto: Google.

Ikke én lancering til alle

Her bliver pressemeddelelsen lidt mere kompliceret, end overskriften gør den. Gemini 3.8 Live bliver gjort tilgængelig for udviklere i Gemini API og Google AI Studio. Virksomhedskunder får en privat forhåndsvisning, mens Google også kobler modellen på Search Live.

Extended Thinking følger sin egen vej. Den kommer til udviklere i API og AI Studio, mens udvalgte funktioner i Gemini Live, Docs, Gmail og Keep knyttes til relevante Google AI-abonnementer. Det er altså ikke én knap, der pludselig tænder på enhver Android-mobil i Danmark.

Det er godt, at Google beskriver forskellen. Den mindre gode nyhed er, at man stadig skal læse det med småt for at vide, om ens konto, sprog og produkt faktisk er med. Gemini 3.8 Live kan blive en bedre måde at bruge AI på. Først skal Google gøre den tilgængelig på en måde, der ikke kræver et organisationsdiagram.

Kilde: Google. Tilgængelighed afhænger af produkt, konto og marked.

Aktører i artiklen

Læs videre i aktørprofilen

Google Gemini Google Gemini er Googles AI-familie for modeller, apps og udviklerværktøjer - og et godt billede på, hvad der sker, når AI bliver bygget direkte ind i en eksisterende internetmaskine. AI-model, assistent og platform

Skriv et svar

Din e-mailadresse vil ikke blive publiceret. Krævede felter er markeret med *