비교
Claude이 패배했습니다. 그 이유는 다음과 같습니다.
우리는 최고 점수를 기록한 Claude Opus와 더 저렴한 오픈 웨이트 모델인 Qwen 3.8을 실제 코딩 대결에서 맞붙였습니다. 승리한 모델은 벤치마크가 예측한 모델이 아니었습니다.
기사 읽기→
Tag
5 개 게시물
우리는 최고 점수를 기록한 Claude Opus와 더 저렴한 오픈 웨이트 모델인 Qwen 3.8을 실제 코딩 대결에서 맞붙였습니다. 승리한 모델은 벤치마크가 예측한 모델이 아니었습니다.
우리는 더 깊이 '추론'하는 모델이 더 똑똑한 AI로 가는 유일한 길이라 믿으며 그런 모델을 쫓아왔습니다. 하지만 새로운 오픈 소스 모델은 이것이 함정임을 증명하며, 의도적으로 이러한 낭비적인 습관을 버림으로써 최고의 결과를 달성했습니다.
새로운 오픈 웨이트 AI가 10일간의 코딩 마라톤을 완주하며 무에서 유를 창조하는 복잡한 앱을 구축했습니다. 이는 단순한 챗봇을 넘어 클로즈드 소스 거대 기업들에 대한 직접적인 도전이자, 자율 개발자의 미래를 엿볼 수 있는 사례입니다.
중국에서 새로 출시된 오픈 소스 모델은 GPT-5와 Fable을 따라잡는 수준을 넘어, 주요 벤치마크에서 이들을 앞서고 있습니다. 하지만 AI 세계에 주어진 이 놀라운 선물 뒤에는 전체 산업을 재편할 수 있는 지정학적 함정이 숨겨져 있습니다.
새로운 오픈소스 AI가 노트북에서 완전히 실행되며, GPT-4V와 같은 대규모 클라우드 모델에 필적하는 성능을 제공합니다. Qwen 2.5 VL이 이미지를 읽고, 코드를 수정하며, 비디오를 로컬에서 분석하여 전 세계 개발자들의 판도를 어떻게 바꾸는지 알아보세요.