메타의 차세대 AI 모델, 음성 기능에 집중
메타(Meta)가 차세대 AI 모델인 Llama 4에서 음성 기능을 핵심 요소로 삼을 계획이다. 기존 텍스트 중심의 모델과 달리, Llama 4는 음성을 포함한 다양한 데이터 유형을 기본적으로 해석하고 출력할 수 있는 "오미(Omni)" 모델로 설계될 예정이다.
실시간 음성 상호작용 기능 구현
특히 메타는 사용자가 AI와의 대화 중간에 끼어들어 인터랙션할 수 있는 기능을 제공하는 데 초점을 맞추고 있다. 이는 OpenAI의 ChatGPT 음성 모드와 Google의 Gemini Live 기능과 유사한 방식으로, 더욱 자연스럽고 유려한 대화를 가능하게 할 것으로 기대된다.
경쟁 심화 속 개발 가속화
메타의 제품 책임자인 크리스 콕스(Chris Cox)는 최근 모건 스탠리 컨퍼런스에서 이러한 기능을 언급했다. 또한, 최근 중국의 인공지능 연구소 DeepSeek에서 공개한 AI 모델이 메타의 Llama 모델과 동급 혹은 그 이상의 성능을 보이면서, 메타도 경쟁력을 유지하기 위해 Llama 4의 개발 속도를 더욱 가속화하고 있는 것으로 전해졌다. 이를 위해 메타는 해당 프로젝트에 전담 팀을 구성하고 적극적인 연구개발(R&D)에 돌입했다.
의견
메타가 Llama 4에서 음성 기반 AI 기능을 강화하는 것은 AI 시장에서의 경쟁이 더욱 치열해지고 있음을 보여준다. OpenAI와 Google이 각각 ChatGPT 음성 모드와 Gemini Live로 실시간 음성 인터랙션 기능을 선보인 만큼, 메타 역시 이에 대응해 자연스러운 대화 경험을 제공하는 데 주력하는 것으로 보인다. 앞으로 Llama 4가 실제로 어떤 혁신적인 기능을 제공할지 기대된다.