📰 핵심 요약

제미나이 사용자의 63%가 음성 기능으로 직접 어시스턴트와 대화하며, 음성이 주류 상호작용 방식으로 자리 잡았음을 보여준다. 구글은 동시에 제미나이가 하루 1억 5천만 장 이상의 이미지를 생성한다고 밝혔다. 자세한 내용은 원문 링크를 참고하라.


💬 JudyAI Lab 관점

제미나이 사용자의 63%가 음성 기능으로 직접 어시스턴트와 대화한다는 사실은, 음성이 이제 텍스트 입력의 부수적 옵션이 아니라 주류 상호작용 방식으로 자리 잡았음을 보여주며, 이 수치 자체가 AI 빌더라면 주목할 만하다.

이는 설계 사고방식의 전환을 반영한다. 대다수 사용자가 타이핑 대신 자연스럽게 음성을 선택한다는 것은, 제품 설계에서 음성을 더 이상 “가산점 기능"으로 취급할 수 없고 핵심 상호작용 경로 중 하나로 다뤄야 한다는 뜻이다. 같은 시점에 구글이 제미나이가 하루 1억 5천만 장 이상의 이미지를 생성한다고 공개한 것을 함께 보면, 사용자와 AI 어시스턴트의 상호작용이 순수 텍스트 대화에서 멀티모달 입출력이 병행되는 방식으로 빠르게 확장되고 있음을 알 수 있다. AI 빌더 입장에서 이는 제품 인터페이스의 전제(사용자가 타이핑하고 텍스트 답변을 읽을 것이라는)가 이미 시대에 뒤처졌을 수 있다는 의미이며, 음성 우선·이미지 우선의 경험 설계가 앞으로의 경쟁 진입 장벽이 될 것이지, 있으면 좋은 부가 옵션이 아니라는 뜻이다.

다음에 AI 제품의 상호작용 흐름을 설계할 때는 먼저 이렇게 물어보자. 사용자가 전혀 타이핑을 하지 않는다면, 이 기능은 여전히 쓸 수 있는가?


📅 원문 정보


🔗 함께 읽으면 좋은 글