24 сентября Google добавила видеоприсутствие в Gemini 3.8 Live в рамках своего предложения Enterprise. Для гостиничной отрасли вопрос заключается в том, что это анимированное лицо вправе говорить, делать и передавать.
Лицо, которое продолжает говорить во время работы
В объявлении, подписанном Shuo-yiin Chang и CJ Zheng от имени аудиокоманды Gemini, Google описывает голос в сочетании с видео, генерируемым почти в реальном времени. Аватар слушает, смотрит и отвечает, используя мимику и синхронизированные с речью движения губ. Он может вызывать инструменты в фоновом режиме, не прерывая разговор. Google также сообщает о переключении между 97 языками без ухудшения изображения.
Единственная гостиничная сцена в тексте — демонстрация: регистрация гостя в отеле, пока инструменты работают в фоновом режиме. Это презентационное видео, а не отзыв заведения, которое использует эту технологию. В объявлении нет никаких измерений задержки, точности или частоты ошибок.
Лицо придаёт ответу вес
Лицо, которое улыбается и смотрит на собеседника, делает общение более понятным. Оно также делает ошибочный ответ более убедительным. Неверный текст на экране читают с недоверием. Тот же самый текст, произнесённый человеком, который кажется внимательным, проверяют менее охотно. Это суждение автора, а не Google, но оно даёт основание рассмотреть вопрос полномочий раньше вопроса внешности.
Перенесём эту мысль на гипотетические ситуации, не описывая реальный случай. Аватар считывает информацию о наличии мест и сообщает её гостю, не имея права оформить бронирование. Другой упоминает тариф или изменение условий пребывания, которые он не может ни подтвердить, ни обеспечить. В обоих случаях формулировка должна пояснять, какие сведения проверяются, что обещается и что ещё должен подтвердить человек. Гость сам не проведёт это различие перед лицом, которое движется настолько плавно.
Что охватывает заявленная прозрачность
Google указывает, что все выходные аудио- и видеоматериалы содержат водяной знак SynthID, который компания называет незаметным. Его функция — позволить впоследствии определить, что контент был сгенерирован. В момент разговора он не сообщает гостю, что тот общается с искусственно созданным собеседником. За эту информацию отвечает заведение: оно должно предоставить её на экране или устно.
Google уточняет, что создание индивидуального аватара на основе референсного изображения доступно только компаниям из списка допущенных. Тогда возникает вопрос о лице: сотрудника, реального человека или вымышленного персонажа? Объявление не рассматривает права, связанные с исходным изображением.
Что заведению следует проверить, прежде чем предоставлять аватар гостям
Оценка должна была бы охватывать полные диалоги, в том числе те, в которых ответа нет. Плавно движущийся аватар, который задерживает контакт с человеком, способным принять решение, ухудшает обслуживание. Поэтому передачу разговора команде нужно проверять наравне с качеством изображения: когда она запускается, что передаётся и приходится ли гостю повторять сказанное.
Визуальная согласованность помогает заведению представить себя. Но доверие зависит от согласованности, которую экран не показывает: каждое обещание аватара должно соответствовать проверенным сведениям, и за него должен отвечать конкретный человек, чью личность можно установить.
Cette publication est également disponible en :
