2. 차세대 구글 어시스턴트와 인공지능 기술

구글 어시스턴트 - 용량 대폭 축소한 차세대 버전 개발

구글은 그 동안 음성 인식 비서 기능인 구글 어시스턴트(Google Assistant)를 강화하기 위해 데이터 센터 파워를 사용해 음성
인식 및 언어 이해 모델을 지원했다.
그러나 딥 러닝 기술과 신경망 네트워크 발전을 기반으로 완전히 새로운 음성 인식 및 언어 이해 모델을 개발해 클라우드에 100GB 용량이
필요했던 모델을 0.5GB 미만으로 줄이는데 성공했다.

새로운 모델을 사용하면 구글 어시스턴트를 위한 인공지능이 스마트폰에서 로컬로 실행 가능해져 네트워크 연결 없이도 실시간으로 음성을 듣고
처리할 수 있는 차세대 어시스턴트를 만들 수 있다. 장치에서 동작하는 차세대 어시스턴트는 사용자의 음성 명령을 이해하고 최대 10배 빠른 응답을
제공할 수 있다.

연속 대화(Continued Conversation)를 통해 매번 "헤이 구글(Hey Google)"이라고 말하지 않고도 멀티태스킹 작업을
하거나 여러 요청들을 연속적으로 처리할 수 있다. 어시스턴트가 하단에 있는 상태에서 여러 앱에 걸친 다양한 명령을 빠르게 처리한다.
차세대 어시스턴트는 올해 말에 새로운 픽셀 폰에서 선보일 예정이다.
구글 듀플렉스 - 웹에서도 간단한 예약 지원

구글은 지난 해 구글 어시스턴트가 듀플렉스(Duplex) 기술을 사용해 전화로 레스토랑에 예약을 하는 방법을 시연한 이후 미국 내
안드로이드 및 iOS 기기의 구글 어시스턴트에 이 기능을 도입했으며 이용자들과 업체들의 긍정적인 반응을 얻고 있다고 밝혔다.

올해는 듀플렉스를 확장해 구글 어시스턴트가 온라인 예약을 쉽게 처리하는 방법을 소개했다. 듀플렉스 온 더 웹(Duplex on the
web)은 온라인으로 예약할 때 여러 페이지를 탐색하고 각종 양식란에 정보를 입력해야 하는데, 듀플렉스 지원 어시스턴트를 바탕으로 복잡한 작업을
빠르게 끝낼 수 있다.

예를 들어 구글 어시스턴트에게 다음 여행 때 필요한 렌트카를 예약하라고 말하면 어시스턴트가 에약 사이트를 검색하고 사용자의
지메일(Gmail)에 저장된 여행 세부 정보나 크롬(Chrome)에 저장된 결제 정보 같은 내용을 입력해주므로 사용자는 예약 시간이나 원하는
차량 옵션 같은 몇 가지 항목만 지정하면 된다.
듀플렉스 온 더 웹은 올해 말 미국과 영국에서 영어로 제공되며, 안드로이드폰에서는 구글 어시스턴트를 통해 렌터가 예약과 영화 티켓 예매를
지원할 예정이다.
개인 정보를 바탕으로 맞춤형 제안

구글 어시스턴트 같은 디지털 비서가 도움이 되기 위해서는 중요한 사람, 장소, 이벤트 같은 내용을 이해해야 한다. 앞으로 몇 달 안에
어시스턴트는 퍼스널 레퍼런스(Personal Reference)를 통해 사용자의 개인 정보와 관련된 내용을 더 잘 이해할 수 있게 된다.
예를 들어 어시스턴트에 연락처 가운데 누가 "엄마"인지 지정했다면 "이번 주말 엄마 집의 날씨는 어때?"라고 묻거나, "여동생의 생일
1주일 전에 꽃을 주문하라고 알려줘"라고 말한다면, 사용자의 개인 정보를 기반으로 어시스턴트가 이를 처리할 수 있다.
물론 이러한 개인 정보는 사용자가 항상 관리할 수 있으며 언제든지 어시스턴트 설정의 You 탭에서 세부 정보를 추가, 편집 또는 제거할 수
있다.

어시스턴트에서 사용자에 대한 이해도가 높아지면 더 유용한 제안을 제공할 수도 있다. 올 여름부터 구글 어시스턴트 기반 스마트
디스플레이(Smart Displays)에서는 'Picks for you'라는 새로운 기능으로 조리법(레시피), 이벤트 및 팟캐스트 같은 사용자
맞춤형 제안을 제공한다.
사용자가 과거에 지중해식 요리 조리법를 검색한 적이 있다면 어시스턴트에게 저녁식사 메뉴를 물었을 때 지중해식 요리를 보여줄 수 있으며,
시간대와 같은 문맥상의 단서를 포착해 아침에는 아침식사 조리법을, 저녁에는 저녁식사 조리법을 제공할 것이다.
어시스턴트를 이용한 운전 모드

구글 어시스턴트에는 새롭게 운전 모드(Driving Mode)가 추가된다. 며칠 전 구글은 자동차용 안드로이드 오토(Android
Auto)에 새로운 디자인을 도입한다고 밝혔는데, 어시스턴트에도 운전 중에 음성으로만 동작 가능한 운전 모드가 올해 여름부터 제공된다.
어시스턴트의 새로운 운전 모드는 운전자가 음성 만으로 필요한 모든 것을 할 수 있도록 내비게이션, 메시지, 전화 및 미디어를 전면 중앙에
오도록 음성 전달 대시 보드를 설계했다.

여기에는 맞춤식 제안이 포함되어 캘린더에서 저녁식사 예약을 했다면 레스토랑에 대한 안내가 표시되고, 집에서 팟캐스트를 듣다가 나왔다면
운전하면서 중단된 부분에서 다시 이어서 들을 수 있다. 운전 중 전화가 오면 어시스턴트가 누구에게 전화가 오는지 알려주고 음성 만으로 전화를
받거나 거절할 수 있다.
어시스턴트의 운전 모드는 별도의 앱 설치 없이 구글 어시스턴트가 탑재된 모든 안드로이드 스마트폰이 자동차의 블루투스에 연결되어 있거나
"헤이 구글, 드라이브 시작(Hey Google, let's drive)'라고 말하면 자동으로 시작된다.
어시스턴트를 사용해 원격으로 차량을 제어할 수 있으므로 집을 나서기 전에 차량 내부 온도를 조절하거나 연료 상태를 확인하고 문이 잠겨있는지
확인할 수 있다.
예를 들어 어시스턴트로 차량의 시동을 걸고 에어컨을 들어 원하는 실내 온도를 맞춰달라는 등의 명령으로 이러한 작업을 수행할 수 있다. 만약
차량을 이용한 출퇴근을 하고 있다면 매일 반복되는 차량 제어 과정을 사용자의 반복 일정에 통합할 수도 있다.
새로운 기능은 현대자동차 '블루링크(Blue Link)' 및 메르세데스 벤츠의 'Mercedes me connect'를 지원하는 기존
자동차 모델에서 사용할 수 있다.

그 밖에 알람이나 타이머를 끌 때는 구글 어시스턴트 호출 명령어를 쓰지 않아도 된다. 예전에는 "헤이 구글"이라고 어시스턴트 호출 명령어를
말한 다음에 타이머나 알람을 끌 수 있었지만, 오늘부터는 그냥 '정지(Stop)'라는 단어 하나로 완전히 멈춘다.
이는 구글에 가장 많이 요청된 기능 중 하나로 영어권 국가의 모든 구글 홈 스피커 및 스마트 디스플레이에서 사용할 수 있다.
인공지능 개발을 위한 새로운 리서치 접근법

구글은 인공지능(AI) 개발을 위해 TCAV(testing with concept aviation vectors)라는 새로운 리서치
접근법을 통해 머신러닝의 편견을 해소하고, 모델이 해석력을 갖추도록 노력하고 있다고 밝혔다.
예를 들어 TCAV는 '얼룩말' 같은 특정 이미지를 찾도록 훈련된 모델에서 어떤 요소에 얼마나 비중을 두고 있는지 보여주는데, 만약
'의사' 이미지를 찾도록 훈련된 모델이 훈련 데이터 내에 남성 의사 이미지가 많아 의도치 않게 '남성'이라는 특징을 중요하게 고려하는지를 찾아낼
수 있다.
구글은 TCAV를 오픈소스로 공개하여 모두가 AI 시스템을 더 공정하고 해석력을 갖추도록 만드는 것을 돕고자 하며 더 많은 도구와 오픈
데이터셋을 공개할 예정이라고 설명했다.

또한 모두를 위한 책임감 있는 개발을 하고자 구글의 제품이 안전하고 사용자의 프라이버시를 보호하도록 만들고 있다고 밝혔다.
구글은 오늘 여러 프라이버시 개선사항을 발표해 사용자가 데이터에 대한 명확한 선택권을 가질 수 있도록 했다. 구글 계정은 사용자의
프라이버시 제어 설정을 한 눈에 보여주는 기능으로, 이제는 더 다양한 제품에서 탭 한 번으로 쉽게 접근할 수 있다.

또한 구글 지도에 시크릿 모드(Secret Mode)가 추가되어 구글 계정과 활동을 연계시키지 않고 장소를 검색하고 길을 찾을 수 있다.
새로운 자동 삭제 제어 기능은 사용자가 데이터를 얼마나 오래 저장할지 선택할 수 있도록 해준다.

안드로이드 스마트폰을 보안 키로 사용해 2단계 인증에서 활용할 수 있도록 지원하며, 안드로이드 7.0 이상 버전에서 오늘부터 이를 사용할
수 있다.

연합 학습(Federated Leraning)이라는 새로운 기술도 소개했다. 제품이 유용해지기 위해 더 많은 데이터를 필요로 한다는 기존의
관념과 달리 미가공 데이터(raw data)가 기기를 벗어나지 않고도 AI 모델을 훈련하고 제품을 더 똑똑하게 만들 수 있다.

구글 키보드인 '지보드(Gboard)'는 사용자가 어떤 것을 입력하는지 알지 못하더라도 수천 명의 사람들이 사용하는 신조어 'BTS',
'YOLO' 같은 단어나 이모티콘 등 입력되는 단어 다음에 올 내용을 예측해서 표시할 수 있다.


다른 언어로 말하는 내용을 실시간으로 번역해주는 '라이브 트랜스크립(Live Transcribe)'는 이제 70개 언어를 지원하게 되었고,
영상과 팟캐스트 가정 내 대화를 실시간 텍스트 자막으로 보여주는 '라이브 캡션(Live Caption)' 기능을 선보였다.

청각 장애로 인해 음성 통화로 소통하는데 어려움을 겪는 사람을 위한 새로운 '라이브 릴레이(Live Relay)' 기술도 공개했다. 전화가
왔을 때 대화창을 켜서 상대방의 목소리를 텍스트로 표시하고, 이쪽에서 키보드로 입력한 대화 내용은 음성 출력으로 상대방에게 들려준다.
그 밖에 정확한 음성을 내기 어려운 사람들을 위한 '프로젝트 유포니아(Project Euphonia)'도 소개했다.