QwQ-32B-Preview: 새롭게 등장한 AI 모델
알리바바의 Qwen 팀이 개발한 QwQ-32B-Preview는 최근 공개된 인공지능 모델로, OpenAI의 모델인 o1과 경쟁할 수 있는 드문 모델 중 하나입니다. 이 모델은 관대하게 허용된 라이선스 하에 다운로드할 수 있는 첫 모델이기도 합니다. 325억 개의 파라미터를 가지고 있어 약 32,000자의 프롬프트를 처리할 수 있으며, 일부 벤치마크에서는 OpenAI의 o1-preview 및 o1-mini보다 우수한 성능을 보입니다.
논리 퍼즐 및 수학 문제 해결 능력
알리바바의 시험에 따르면, QwQ-32B-Preview는 AIME와 MATH 테스트에서 OpenAI의 모델들을 능가합니다. 이 AI 모델은 논리 퍼즐과 복잡한 수학 문제를 해결할 수 있는 능력을 가지고 있지만, 일부 경우에 언어를 예상치 못하게 바꾸거나 반복적으로 같은 답을 내놓는 등의 한계도 있습니다.
정치적 주제에 대해 신중한 응답
QwQ-32B-Preview는 자가 검증 기능을 갖추고 있어 잘못된 정보를 피할 수 있지만, 결과를 도출하는 데 시간이 더 걸릴 수 있습니다. 중국의 인터넷 규제에 맞춰 특정 정치적 주제에 대해서는 신중하게 답변하는 특징을 보이며, 텐안먼 광장 등에 대한 질문에는 비응답을 유지합니다.
Apache 2.0 라이선스 하에서 상업적 이용 가능
QwQ-32B-Preview는 상업적 용도로 사용할 수 있으며, Apache 2.0 라이선스 하에서 "오픈"으로 제공됩니다. 하지만 모델의 일부 구성 요소만 공개되어 있어 이를 직접 복제하거나 시스템의 내부 작동 방식을 완전히 이해하기는 어렵습니다.
AI 모델 개발의 새로운 접근법
대규모 데이터와 컴퓨팅 파워를 투입하여 성능을 높이려는 기존의 "스케일링 법칙"이 제한됨에 따라, 새로운 AI 접근 방식으로서 테스트 시컴퓨트(test-time compute)가 주목받고 있습니다. OpenAI, Google, Anthropic과 같은 주요 AI 연구소들의 모델 성능이 최근 크게 개선되지 않음에 따라 다른 기술들이 대두되고 있으며, Google은 이러한 연구에 더욱 집중하고 있습니다.
출처 : Alibaba releases an ‘open’ challenger to OpenAI’s o1 reasoning model