Gemini Live Avatar 공개: AI 상담원에게 얼굴이 꼭 필요할까?

4분 읽기조회 2
공유

배송이 늦어 고객센터를 열었다. 화면 속 AI 상담원이 눈을 맞추고, 고개를 끄덕이며 답한다. 그런데 정작 내가 원하는 배송 날짜는 알려주지 못한다.

이건 실제 서비스 이용 후기가 아니라, 새 AI 기능을 볼 때 떠올려볼 만한 가상의 장면이다. 상담원의 표정이 자연스러워진 것과 상담이 나아진 것은 같은 일일까?

구글은 9월 24일 Gemini 3.8 Live with Live Avatar를 발표했다. 실시간 음성 대화에 영상 생성을 결합해, 보고 듣고 말하는 아바타를 제공하는 기능이다. 입 모양과 표정을 음성에 맞추고, 대화 도중에도 백그라운드에서 도구를 호출할 수 있다고 설명한다. 구글 공식 발표

이 발표에서 흥미로운 부분은 AI가 사람처럼 보인다는 사실만이 아니다. 이제 서비스를 만드는 쪽은 사용자 앞에 어떤 얼굴을 내세울 것인지, 아예 얼굴이 필요한지까지 결정하게 됐다.

먼저, 내 Gemini 앱에서도 쓸 수 있나?

발표에 명시된 제공 경로는 Gemini Enterprise다. 일반 소비자용 Gemini 앱의 모든 사용자에게 아바타 영상 통화가 열렸다는 소식으로 읽으면 안 된다.

기본 아바타 외에 참조 이미지로 맞춤 아바타를 만드는 기능도 소개됐지만, 맞춤 생성은 현재 기업 대상 허용 목록에 등록된 경우로 제한된다. 누구나 사진을 올리면 즉시 사용할 수 있다고 안내하기에는 조건이 다르다. 이 글은 9월 28일 확인한 발표 내용 기준이며, 직접 사용해본 리뷰는 아니다. 출시 범위와 맞춤 아바타 조건

제품을 이해하려면 같은 발표문의 데모를 보는 편이 좋다. 정지 이미지로는 대화 중 끼어들기나 표정의 타이밍을 판단하기 어렵다. 특히 호텔 체크인 데모에서는 대화를 이어가면서 도구로 정보를 조회하는 모습을 보여준다. 다만 공개 데모만으로 실제 서비스의 응답 속도나 오류율까지 알 수는 없다.

얼굴이 도움이 되는 순간과 방해가 되는 순간

가상의 서비스 두 개를 생각해보자.

하나는 외국어 회화 연습 앱이다. 사용자가 말을 멈췄을 때 상대가 기다리는지, 다시 말해도 되는지 느끼게 해주는 것이 경험의 일부다. 이 경우 아바타의 표정과 시선은 장식 이상의 역할을 할 여지가 있다. 대화하는 느낌 자체가 사용자가 원하는 결과이기 때문이다.

다른 하나는 택배 배송 조회다. 사용자는 송장 번호를 넣고 도착 예정일을 확인한 뒤 나가고 싶다. 여기서는 말하는 얼굴보다 정확한 날짜 한 줄과 배송 상태가 잘 보이는 편이 유용할 수 있다. 같은 기능이라도 사용 목적에 따라 가치는 반대가 된다.

그래서 도입 회의에서 먼저 물어볼 질문은 “우리 브랜드에 어떤 캐릭터가 어울릴까?”가 아니다.

“사용자는 여기서 대화하고 싶은가, 아니면 대화 없이 일을 끝내고 싶은가?”

이 질문을 건너뛰면, 원래 버튼 하나로 끝나던 업무를 친절한 아바타와 여러 번 대화해야 하는 서비스로 바꾸기 쉽다. AI의 표현력이 늘어났다고 사용자에게 더 많은 대화를 요구할 이유는 없다.

반대로 복잡한 제품의 첫 사용을 안내하거나 대화 연습을 돕는 서비스라면 충분히 실험할 가치가 있다. 단, 이는 이번 기능의 효과가 입증됐다는 뜻이 아니라 검증해볼 제품 가설이다.

검증 방법도 얼굴의 자연스러움만 묻는 설문에 머물 필요가 없다. 같은 모델과 같은 지식, 같은 도구 권한을 유지한 채 음성만 제공한 경우와 아바타를 함께 제공한 경우를 비교해볼 수 있다. 사용자가 과제를 끝냈는지, 중간에 포기했는지, 잘못 이해해 다시 질문했는지를 보면 된다. 대화 시간이 길어졌다는 사실만으로 성공이라고 판단해서는 안 된다. 회화 앱에서는 좋은 신호여도 배송 조회에서는 불편의 신호일 수 있다.

친절한 표정은 답변의 근거가 아니다

개발자로서 더 신경 쓰이는 장면은 아바타가 틀린 말을 할 때다.

텍스트로 표시된 “환불 가능합니다”도 잘못된 안내가 될 수 있다. 여기에 확신에 찬 목소리와 자연스러운 미소가 붙으면 사용자가 어떻게 받아들일지까지 고려해야 한다. 실제로 신뢰가 얼마나 달라지는지는 측정할 문제지만, 적어도 표정을 답변의 정확성 지표로 취급해서는 안 된다.

따라서 화면을 설계한다면 아바타 옆에 확인 가능한 정보가 머물 자리를 남겨두고 싶다. 예약 날짜, 적용된 요금, 안내의 근거처럼 사용자가 다시 읽어야 하는 정보다. 말은 지나가고 표정은 바뀌지만, 중요한 조건까지 함께 사라져서는 곤란하다.

사람 상담원 연결 버튼도 같은 이유로 중요하다. 아바타와 잘 대화하는 능력이 문제 해결의 입장권이 되어서는 안 된다. 카메라를 쓰지 않거나 영상을 끄고 싶은 사용자를 위한 경로 역시 별도로 생각해야 한다. 이것들은 구글이 제공한다고 확인한 기능 목록이 아니라, 이 기술로 서비스를 만든다면 제안하고 싶은 설계 조건이다.

구글은 생성된 오디오·비디오에 SynthID 워터마크를 적용한다고 설명한다. 그러나 생성물을 식별하는 기술과 사용자에게 “지금 AI와 대화 중입니다”라고 명확히 알리는 화면은 역할이 다르다. 워터마크가 답변 내용의 정확성을 보증하는 것도 아니다. 워터마크에 관한 공식 설명

Live Avatar는 모든 챗봇에 얼굴을 붙이라는 신호보다는, AI 서비스가 선택할 수 있는 인터페이스가 하나 늘어난 사건으로 보고 싶다. 어떤 제품에서는 그 얼굴이 대화를 시작하게 만들 것이다. 어떤 제품에서는 화면을 차지할 뿐일 것이다.

처음의 배송 조회 화면으로 돌아가보자. 상담원이 얼마나 자연스럽게 웃는지보다 먼저 확인할 것이 있다. 내가 언제 택배를 받는지 알게 됐는가. 좋은 AI 상담의 기준은 얼굴이 생긴 뒤에도 그 질문에서 출발한다.

댓글을 작성하려면로그인이 필요합니다.