Google је 24. септембра омогућио општу доступност Live Avatar-а уз Gemini 3.8 Live. Функција додаје лице које говори и анимирано је у складу са говором у модел уживо, који може да прима и улаз са камере или екрана и да позива спољне алатке током разговора. Програмерима који праве агенте за директну комуникацију са корисницима, практична промена доноси интегрисани видео-излаз и документован пут до API-ја. Објава не доказује да аватар побољшава исходе услуге нити да поуздано ради у сваком окружењу.

Кључна промена

  • Шта се променило: Google-ов водич за програмере додаје синхронизовани видео-аватар говорном излазу доступном у ранијем моделу Live. Програмери сада могу да добију лице које говори и глас путем једног API-ја за стриминг.
  • Зашто је важно: Тимови који развијају агенте за корисничку подршку могу да додају визуелно присуство без посебног система за приказивање аватара. Њихове апликације и даље извршавају позиве алатки и обрађују грешке; анимација не доказује да је трансакција успела.
  • Шта треба пратити: Непосредан избор је између унапред припремљеног аватара и прилагођеног лика. Google-ов водич за подешавање ограничава прилагођене аватаре на одабране кориснике и захтева права и пристанак за узорке лица или гласа. За брендираног аватара зато су потребне засебне одлуке о приступу и пристанку.

Аватар је доступан; прилагођени лик има посебна ограничења

У својој објави о покретању Google приказује аватаре који реагују на звук и визуелни улаз уживо, мењају језике и настављају разговор о пријави у хотел док је позив алатке у току. То су демонстрације компаније. Оне приказују замишљени начин интеракције, али не пружају измерене стопе грешака, резултате приступачности нити доказе о бољој корисничкој услузи.

Google-ова објава Cloud услуге наводи да је функција опште доступна у Gemini Enterprise-у и преко API-ја, са крајњим тачкама у САД и ЕУ. Програмери могу да бирају између унапред припремљених аватара. Израда аватара на основу референтне слике особе и даље је ограничена на одабране пословне кориснике, који приступ морају да затраже преко Google Cloud-а. Водич за подешавање наводи да су корисници одговорни за прибављање права и пристанака потребних за обраду узорака лица или гласа.

На страници модела наведени су gemini-3.8-live и доступност у us и eu вишерегионалним окружењима и us-central1. Наведене су и стандардна наплата по потрошњи и унапред резервисани проток као подржане опције коришћења. Тимови треба да провере крајњу тачку и комерцијалне услове за своје увођење пре него што општу доступност протумаче као универзалан приступ.

Разговор и даље зависи од апликације

Google описује Gemini 3.8 Live као систем за говор-у-говор који може да прима кадрове камере уживо или дељење екрана и да узврати говором и видеом. Његов водич за програмере разликује позиве који се извршавају док агент наставља да говори од блокирајућих позива који чекају одговор. Апликација и даље мора да повеже сопствене алатке и овласти их, обради резултате и одлучи које радње агент сме да предузме. То што лице остаје на екрану током претраге не доказује да је претрага успела.

Водич наводи да одговори алатки треба да прикажу статус и да ли је поновни покушај примерен; морају да одговарају ID-ју првобитног позива; а програмери треба да ограниче број поновљених позива алатки. Ови захтеви утичу на то како агент поступа када претрага корисничког налога не да резултат или дође до прекида. Google такође наводи да Gemini 3.8 Live може да прелази између 97 језика. Тврдња у објави да покрети усана остају усклађени у свим тим језицима овде није независно измерена.

Google тврди да генерисани звук и видео садрже водене жигове SynthID-а и ограничава израду прилагођених ликова. То су наведене мере заштите, а не доказ да ће сваки гледалац препознати да је аватар синтетички или да је злоупотреба спречена. Процена примене морала би да провери пристанак, обавештавање, обраду видео-података уживо и гласа, неуспеле позиве алатки, понашање при прекиду и стварне резултате код конкретних корисника. Објава о покретању и објављена документација не пружају те резултате.

Извори и додатна литература

  • Google-ова објава о Live Avatar-у (24. септембар 2026) описује и приказује предвиђене начине интеракције, тврдње о вишејезичном аватару и SynthID-у. Демонстрације нису независни тестови перформанси.
  • Објава Google Cloud-а о општој доступности (24. септембар 2026) наводи доступност за предузећа, крајње тачке у САД и ЕУ, унапред припремљене аватаре и ограничен приступ прилагођеним аватарима, као и примере примене. Коментари корисника у објави су промотивне изјаве, а не мерење исхода коришћене у овом тексту.
  • Водич за програмере Gemini 3.8 Live (ажуриран 24. септембра 2026) документује поређење модела, формат стриминга и понашање позива алатки. Описује рад API-ја, а не измерене перформансе у конкретној примени.
  • Страница модела Gemini 3.8 Live (ажурирана 24. септембра 2026) наводи ID модела, датум опште доступности, регионе и опције потрошње. Доступност треба поново проверити за конкретан пројекат и крајњу тачку.
  • Подешавање аватара уживо (проверено 25. септембра 2026) описује подешавање API-ја за унапред припремљени аватар, као и услове приступа и пристанка за прилагођени лик.