미국의 AI 자존심에 스크래치를 낸 중국의 deepseek r1모델에 이어 알리바바가 qwen 2.5 max라는 대형 모델을 공개했습니다.
벤치마크 상으로는 chatGPT 4o, claude 3.5 sonnet같은 모델들과 어깨를 나란히 할 수 있는 수준입니다.
특히 claude의 artifacts기능을 가지고 있습니다.
qwen은 MoE(Mixture of Experts) 모델로 여러개의 모델을 가지고 있습니다.
이번 qwen 2.5 max의 소개는 아래와 같습니다. The most powerful language model in the Owen series.
이 외에도 비전,코드 등 여러 모델들이 있습니다.
라이센스는 월 활성하용자가 1억명이상일 때는 알리바바로부터 라이센스를 취득해야 합니다.
00:00 오프닝 00:46 Qwen 2.5 max 소개 03:06 테스트 소개 04:21 Qwen 모델 리스트 05:29 테스트 시작 06:08 1번:문자패턴 06:29 2번: 어떤 수에 5를 더하면 2배보다 3 작음 06:53 3번: 5가지 색 반복. 57번째 색 맞추기 07:19 4번: 5명이 사과 먹는 순서 07:40 5번: 5개의 모자중 자신이 쓴 모자색 맞추기 09:49 6번: 9개 동전중 가짜 동전 찾기 10:53 7번: 26개 동전중 가짜 동전 찾기 11:35 8번: 현재 아버지 나이 아들의 4배 12:51 9번: 3명 용의자중 한명만 진실 15:22 10번: 2개의 8각 주사위 확률. 17:43 11번: 2차방정식 풀기 웹앱(코딩) 23:46 다른 모델로 수정(ft.claude) 25:43 결론