AI-mallit ja alustat
Google tuo Live Avatar -visuaalisen läsnäolon Gemini 3.8 Live -malliin

Google esitteli 24. syyskuuta 2026 Gemini 3.8 Live with Live Avatar, ominaisuuden, joka lisää lähes reaaliaikaisesti luotua videota sen natiivien live‑keskustelumallien puheeseen, ja teki sen yleisesti saatavaksi Gemini Enterprise -palvelussa Yhdysvaltojen ja Euroopan unionin päätepisteiden kautta.
Ilmoituksen, jonka ovat kirjoittaneet tutkimustieteilijä Shuo-yiin Chang ja ohjelmistosuunnittelija CJ Zheng Gemini Audio -tiimin puolesta, esittelee ominaisuuden visuaalisena läsnäolokerroksena Geminin keskustelevalle tekoälylle. Google sanoo, että sen tarkka huulenliikennesynkronointi, luonnolliset ilmeet ja sujuva vuorottelu mahdollistavat yrityksille virtuaalisten palveluiden, kuten asiakaspalvelun ja interaktiivisten esittelyjen, laajentamisen.
Julkaisu seuraa Googlen 15. syyskuuta 2026 julkaisu Gemini 3.8 Live ja Gemini 3.8 Live Extended Thinking, live‑keskustelumalleja, jotka Google asetti skaalautuvaa, kustannustehokasta keskustelua ja korkean monimutkaisuuden päättelytehtäviä varten, ja jotka alkoivat levitä Gemini API:n, Google AI Studion, Gemini‑sovelluksen, Google Workspacen ja Search Live -palvelun kautta.
Yleinen saatavuus Gemini Enterprise -palvelussa
Gemini 3.8 Live with Live Avatar on yleisesti saatavilla Gemini Enterprise -palvelussa 24. syyskuuta 2026, ja Google Cloud kertoi teknologian ensimmäisen esikatselun tapahtuneen Google Cloud Next 2026 -tapahtumassa. Julkaisu on tarjolla Yhdysvaltojen ja EU:n päätepisteiden kautta ja sisältää varatun läpimenon, yritysten vaatimustenmukaisuuden ja tiukan tietohallinnon, Google Cloud -julkaisun mukaan, jonka on kirjoittanut Fabien Blanc-paques, Gemini Live -ryhmän tuotepäällikkö. Gemini 3.8 Live Extended Thinking on edelleen yksityisessä esikatselussa.
Yritysasiakkaat voivat kokeilla mallia Gemini Enterprise -konsolissa, integroida sen Gemini Live API -dokumentaation kautta ja tarkastella hinnoittelua Google Cloudin hinnoittelusivulta. Google Cloud kehottaa asiakkaita tekemään yhteistyötä myyntiedustajiensa kanssa varatun läpimenon, räätälöityjen käyttöönottoarkkitehtuurien ja mukautettujen avatarien sallittujen listojen osalta.
Kuinka Live Avatar toimii
Live Avatar käsittelee visuaalisia ja äänisyötteitä samanaikaisesti ja vastaa ilmaisevalla äänellä ja videolla lähes reaaliajassa, Googlen mukaan. Ominaisuus tukee myös asynkronista työkalukutsua, joten se voi käynnistää työkalukutsuja ja hakea tietoja taustalla keskeyttämättä keskustelua. Yksi Googlen demonstraatio näyttää avatarin tarkistavan hotellivieraan samalla kun dialogi jatkuu ilman keskeytystä.
Google sanoo, että avatari säätää huulenliikennesynkronointia ja ilmeitä keskustelujen edetessä 97 kielellä, säilyttäen videon tarkkuuden eikä aiheuttaen visuaalista häiriötä. Google Cloud -julkaisu lisää live‑visuaalisen ymmärryksen kamerasyötteistä ja näytönjaosta äänen ohella, keskeytyksen palautuksen, joka säilyttää keskustelukontekstin ja taustatransaktiot, automaattisen kielentunnistuksen ja siirtymän ilman manuaalisia kytkimiä sekä käyttöönoton verkossa, mobiilissa ja interaktiivisissa kioskeissa. Erillinen Google Cloud -demo näyttää vakuutuskorvauspyyntöjen vastaanottajan täyttävän korvausmuistion, kun asiakas näyttää vahinkoa kameralla, samalla kun Googlen Agent Development Kitillä rakennettu agenttitiimi tarkistaa vakuutuksen, soveltaa vastaanottoehtoja ja kokoaa korjauspaketin taustalla.
Avatarit, vesileimaus ja mallikortin rajoitukset
Organisaatiot voivat ottaa käyttöön kirjastosta ennalta määritettyjä avatarita tai luoda mukautettuja avatarita korkealaatuisesta referenssikuvasta, ja Google toteaa, että tulos säilyttää referenssin yhtäläisyyden, brändityylin tai hahmon identiteetin. Mukautettujen avatarien luomiseen pääsy edellyttää yritystason sallittujen listojen käyttöä; Google Cloud kuvaa sallittujen listojen ja vahvistusprosessin identiteetin suojaksi ja väärinkäytön estämiseksi. Jokainen luotu ääni- ja videovirta upotetaan huomaamattomaan SynthID‑vesileimaan, mikä pitää AI‑luodun sisällön tunnistettavana.
Gemini 3.8 Audio -mallikortti mukaan mallit perustuvat Gemini 3 Proon. Gemini 3.8 Live hyväksyy äänen, kuvat, videon ja tekstin kontekstin ikkunalla enintään 128 K tokenia, ja Live Avatarin avulla se tuottaa äänen, videon ja tekstin, joiden ulostulo on rajoitettu 24 K tokeniin. Mallikortti kertoo, että Live Avatar -variantit tuottavat ilmaisemista videota luonnollisista pään liikkeistä, jotka on synkronoitu puheeseen, ja joita ohjaavat määritetyt kuvat ja äänisyötteet, ja että ne kestävät muutaman minuutin jatkuvaa vuorovaikutusta, eikä useita tunteja.
Mallikortti luettelee tunnetut rajoitukset, joihin kuuluvat mahdolliset harhakuvitelmat sekä satunnainen hidastelu tai aikakatkaisut, ja asettaa tiedonrajauksen tammikuuhun 2025. Sen frontier‑turvallisuusarviointi ei löytänyt merkittäviä uusia kykyjä tai merkittäviä suorituskyvyn parannuksia Gemini 3.7 Flash -malliin verrattuna, ja tämän perusteella Google katsoo, että Gemini 3.8 Audio -mallit eivät todennäköisesti saavuta mitään seurattuja tai kriittisiä kyvykkyystasoja Frontier Safety Framework -järjestelmässä.
Asiakkaiden käyttöönotot
Google Cloud mainitsi useita yrityksiä, jotka rakentavat ominaisuutta. Cox Automotive loi AI‑pohjaisen ostosavustajan Autotraderille, joka käyttää live‑näytön korostusta ja työkalukutsuja ohjatakseen autokauppiaita ajoneuvon hakuun, vertailuun ja rahoitukseen reaaliajassa.
“Kuluttajat odottavat yhä enemmän, että he voivat kuvailla tarpeitaan omilla sanoillaan sen sijaan, että heidän täytyy selata suodattimia ja valikoita. Autotraderin uusi keskusteleva AI‑avatar tuo tämän kokemuksen ajoneuvojen etsintään yhdistämällä luonnollisen keskustelun oikeaan varastoon,” Marianne Johnson, Cox Automotivein varapuheenjohtaja ja päätuotejohtaja, sanoi Google Cloud -julkaisussa.
Equal AI:n toimitusjohtaja Akhilesh Damaraju kertoi, että yrityksen henkilökohtainen AI käsittelee yli miljoonaa suoraa puhelua päivittäin yhdeksässä intialaisessa kielessä, ja totesi, että Gemini 3.8 Live paransi keskeytysten käsittelyä, monikielisiä keskusteluja ja työkalukutsujen luotettavuutta. Bob Van Osten, Salesforcen varapuheenjohtaja tuotealueesta Agentforce, sanoi, että Agentforce ja Gemini 3.8 Live yhdistyvät yhteistyössä Salesforce AI Researchin ja Googlen välillä, mikä yhdistää reaaliaikaiset multimodaaliset ominaisuudet agenttipohjaiseen AI:hin. Eric Walsh, Specs‑yrityksen ohjelmistosuunnittelija, totesi, että mallin puheaktiivisuuden tunnistuksen päivitykset ja latenssin parannukset olivat askelia eteenpäin AI‑avustajalle SPECS‑alustalla.












