Google lanserer Live Avatar i Gemini Enterprise: samtale-KI med leppesynkroniserte ansikter i sanntid
Google lanserte 24. september Gemini 3.8 Live med Live Avatar i generell tilgjengelighet for Gemini Enterprise-kunder — en samtale-KI med en animert persona som leppesynkroniserer og viser ansiktsuttrykk i sanntid.

Google lanserer Live Avatar i Gemini Enterprise: samtale-KI med leppesynkroniserte ansikter i sanntid
Google lanserte 24. september Gemini 3.8 Live med Live Avatar i generell tilgjengelighet for Gemini Enterprise-kunder — en samtale-KI med en animert persona som leppesynkroniserer og viser ansiktsuttrykk i sanntid. Funksjonen ble første gang vist på Google Cloud Next 2026, og kommer én dag etter selskapets nye tekst-til-tale-modeller, i en uke der Google samler lyd- og videotilbudet sitt i ett enterprise-produkt.
Hva som ble lansert
Ifølge The Verge kan brukere med Gemini 3.8 Live-oppdateringen føre samtaler med modellen mens en animert AI-persona svarer i sanntid. «Live Avatar»-en leppesynkroniserer og viser ulike ansiktsuttrykk under samtalen. Foreløpig er funksjonen kun tilgjengelig for Gemini Enterprise-kunder — forbrukere får ikke tilgang ennå.
Android Headlines, som også dekker lanseringen, beskriver at funksjonen kombinerer sanntids videogenerering direkte med talemodeller på tvers av nettsider, mobilapper og interaktive selvbetalingsautomater — innsatspunkter der bedrifter i dag typisk bruker tekstchat eller fysiske betjeningspunkter.
Hvordan det fungerer
De teknisk mest konkrete detaljene kommer fra Android Headlines, og bør leses med det forbeholdet at de ikke er uavhengig bekreftet: Live Avatar-motoren skal prosessere visuelle og lydlige inndata samtidig, slik at avataren kan se brukerens kamerabilde eller skjermdeling og føre «naturlige samtaler» ut fra det den ser. Systemet skal dessuten støtte asynkrone verktøykall — backend-oppgaver som kjører mens samtalen pågår, slik at avataren kan slå opp i bedriftens systemer uten å fryse samtalen. Rapporten knytter også funksjonen til Googles Agent Development Kit (ADK), rammeverket selskapet tilbyr for å bygge agenter.
Det er verdt å understreke skillet: At avataren leppesynkroniserer og viser ansiktsuttrykk i sanntid, er rapportert av The Verge med henvisning til Google. Detaljene om kamerainngang, asynkrone verktøykall og ADK-integrasjon står i Android Headlines alene, og er ikke bekreftet av andre kilder i dette grunnlaget.
Språk og kvalitet — Googles påstand
Google hevder at Live Avatar kan veksle mellom de 97 språkene det støtter «uten å forringe videokvaliteten eller innføre visuell drift» — altså at avatarens utseende og bildekvalitet skal være stabil på tvers av språkskifter. Dette er en leverandørpåstand, sitert av The Verge, og ikke uavhengig verifisert. For bedrifter som opererer på tvers av språk, er det nettopp denne typen konsistens som er avgjørende — men vi vet ikke hvordan ytelsen faktisk oppfører seg i praksis.
Egendefinerte avatarer og vannmerking
Google tilbyr et bibliotek med forhåndsdefinerte avatarer bedriftene kan velge mellom, men organisasjoner kan også lage sine egne. Ifølge Android Headlines kreves det bare ett referansebilde og én lydprøve for å lage en egen persona — men opprettelsen er underlagt streng godkjenning via en tillatelsesliste. Hvor stor denne listen er, eller hvem som står på den, er ikke offentliggjort.
Alle utdata skal ifølge Google bære selskapets usynlige SynthID-vannmerke, sammen med sikkerhetstiltak for å «respektere identitet». Det siste er en åpenbar respons på risikoen ved teknologi som kan animere ansikter ut fra ett enkelt bilde og én lydprøve: at samme kapasitet kan misbrukes til deepfakes. Hvordan vannmerkingen fungerer i praksis, og hvor robust den er, er ikke dokumentert i det tilgjengelige grunnlaget.
Konteksten: en travel uke og press fra konkurrentene
Live Avatar lander dagen etter at Google introduserte Gemini 3.8 TTS og Gemini 3.8 Flash-Lite TTS (23. september), som selskapet posisjonerer som sine mest kapable lydgenerasjonsmodeller noensinne, ifølge TechTarget. De to lanseringene samme uke fremstår som en pakke der lyd og video settes sammen til ett produkt.
Analysten Bradley Shimmin i Futurum Group karakteriserte TTS-arbeidet slik overfor TechTarget (sitatet er oversatt fra engelsk): «Det vi ser her er en finpussing av tekst-til-tale, med en del målretting mot spesifikke bruksområder.» Med andre ord: forfinelse, ikke gjennombrudd — og hovedgevinsten for bedrifter er at alt nå samles i én modellfamilie.
Android Headlines rammer inn lanseringen i konkurransemessig press: Selskapets aksjer skal ha falt rundt 20 prosent i de seneste månedene etter rapporterte forsinkelser med Gemini 3.5 Pro, samtidig som konkurrentene OpenAI og Anthropic har lansert nyere konkurrerende modeller, og en Google DeepMind-sjef skal ha teasert Gemini 4. Dette er opplysninger fra én enkelt kilde som ikke er bekreftet av andre kilder her, og bør leses med det forbeholdet.
Åpne spørsmål
Flere sentrale detaljer mangler fortsatt: Googles egen primærdokumentasjon (offisielt blogginnlegg, utgivelsesnotater eller Enterprise-dokumentasjon) inngår ikke i grunnlaget for denne saken, så alle kapabilitetspåstander bygger på sekundær dekning som igjen siterer Google. Prisingen er ikke kjent. De spesifikke «enterprise compliance-garantiene» som nevnes, er ikke presisert. Det er uklart om og når Live Avatar blir tilgjengelig utenfor Gemini Enterprise, for eksempel for forbrukere i Gemini-appen. Og vi vet ikke hvordan SynthID-deteksjon faktisk fungerer i praksis for denne typen videoutdata.
Det som likevel er klart, er retningen: Realistiske, talende og seende AI-ansikter er ikke lenger et demoprogram fra en konferansescene, men et produkt bedrifter kan ta i bruk i dag — med de tekniske, kommersielle og etiske spørsmålene det medfører.
Kilder
- Gemini 3.8 Live with Live Avatar gives Google’s AI a face | The Verge — www.theverge.com
- Gemini 3.8 text-to-speech refines voice AI capabilities | TechTarget — www.techtarget.com
- Google Gemini 3.8 Arrives with Real-Time AI Avatars — www.androidheadlines.com