Skip to content
AI 도구

JetBrains Mellum 2 리뷰

Mellum 2는 소프트웨어 엔지니어링에 특화된 12B-parameter Mixture-of-Experts (MoE) 언어 모델로, 추론 효율성을 위해 최적화되었습니다.

shipped 2026년 6월 2일aifreemium
aiproduct-hunt
JetBrains Mellum 2 - AI tool

핵심 포인트

1오픈 웨이트 12B-parameter Mixture-of-Experts (MoE) 언어 모델.
2토큰당 2.5B 활성 파라미터를 특징으로 하여 일반 GPU에서 빠른 추론 속도를 가능하게 합니다.
3코드 생성 및 편집을 포함한 소프트웨어 엔지니어링 작업에 특화되어 있습니다.
42026년 6월 1일, 관대한 Apache 2.0 라이선스 하에 출시되었습니다.

Stork’s verdict on JetBrains Mellum 2

Mellum 2는 오픈 웨이트의 전문 소프트웨어 엔지니어링 모델이지만, 시스템 통합을 위한 focal model로 설계되었습니다.

JetBrains Mellum 2 reviewed by Stork AI · stork.ai/ko/jetbrains-mellum-2

사양

API 제공 여부

예, 공개 API

overview

JetBrains Mellum 2란 무엇인가요?

JetBrains Mellum 2는 JetBrains에서 개발한 Mixture-of-Experts (MoE) 언어 모델 도구로, 소프트웨어 엔지니어가 코드를 효율적으로 생성하고 편집할 수 있도록 합니다. 이는 토큰당 2.5B 활성 파라미터를 가진 오픈 웨이트 12B-parameter 모델이며, 소프트웨어 엔지니어링 작업에 특화되어 있습니다. Mellum 2는 코드 생성 및 편집, 디버깅, 다단계 추론 수행, 외부 도구 활용, 에이전트 워크플로우 실행, 대화형 프로그래밍 지원 등 다재다능한 코딩 비서 역할을 합니다. 일반 GPU에서 추론 효율성을 위해 최적화되어 있으며, 속도와 낮은 지연 시간을 강조하는 AI 기반 개발자 워크플로우에 통합되도록 설계되었습니다.

features

JetBrains Mellum 2의 주요 기능

JetBrains Mellum 2는 120억 개의 파라미터를 가진 Mixture-of-Experts (MoE) 아키텍처를 통합하여, 밀집 모델과 차별화됩니다. 이 설계는 토큰당 25억 개의 활성 파라미터를 허용하여 일반 GPU에서 추론 효율성을 최적화합니다. 이 모델은 소프트웨어 엔지니어링에 특화되어 훈련되었으며, 광범위한 코딩 작업을 포함합니다. 그 기능은 기본적인 코드 생성을 넘어 고급 코드 편집 및 다단계 추론까지 확장됩니다.

  • 오픈 웨이트 12B-parameter Mixture-of-Experts (MoE) 아키텍처.
  • 효율적인 추론을 위한 토큰당 2.5B 활성 파라미터.
  • 소프트웨어 엔지니어링 작업에 특화.
  • 코드 생성 기능.
  • 코드 편집 기능.
  • 일반 GPU에서 추론 효율성을 위해 최적화.
  • 수학 및 추론 작업 지원.
  • 도구 사용 및 에이전트 워크플로우 촉진.
  • Apache 2.0 라이선스 하에 출시.

use cases

누가 JetBrains Mellum 2를 사용해야 하나요?

JetBrains Mellum 2는 소프트웨어 엔지니어링 작업을 위한 효율적이고 특화된 AI 모델을 찾는 개발자와 조직을 위해 설계되었습니다. 그 아키텍처와 훈련은 속도와 제어가 가장 중요한 다양한 AI 기반 개발자 워크플로우에 통합하기에 적합합니다. 모델의 복잡한 추론 및 도구 사용 능력은 고급 AI 시스템의 구성 요소로서의 위치를 확고히 합니다.

  • AI 워크로드 라우팅 및 오케스트레이션: 다중 모델 시스템에서 적절한 모델 또는 도구를 선택하기 위해 프롬프트 분석.
  • 저지연 RAG 파이프라인 구축: 빠른 응답 생성을 위한 컨텍스트 압축, 요약 및 검색 후처리 처리.
  • 복잡한 워크플로우에서 빠른 서브 에이전트 구동: 더 큰 에이전트 파이프라인 내에서 컨텍스트 수집, 계획, 유효성 검사 및 변환과 같은 특수 작업 실행.
  • 프라이빗, 로컬 AI 배포 활성화: 코드 및 데이터에 대한 완전한 제어를 위해 Apache 2.0 라이선스 하에 모델을 로컬로 실행하거나 자체 호스팅.
  • 일반 소프트웨어 엔지니어링 작업: 코드 생성, 디버깅 및 대화형 프로그래밍 지원.

pricing

JetBrains Mellum 2 가격 및 플랜

JetBrains Mellum 2는 프리미엄 모델로 운영됩니다. 핵심 모델 가중치는 관대한 Apache 2.0 라이선스 하에 오픈 소스로 공개되어 개발자가 직접적인 라이선스 비용 없이 모델을 다운로드, 사용 및 로컬로 배포하거나 자체 호스팅할 수 있습니다. 이는 데이터 및 코드에 대한 완전한 제어를 가능하게 하여 프라이빗하고 프로덕션에 적합한 코딩 애플리케이션에 적합합니다. 모델 자체는 무료로 사용할 수 있지만, JetBrains의 더 넓은 개발자 도구 생태계 및 잠재적인 미래 클라우드 호스팅 서비스 또는 프리미엄 통합은 별도의 가격 구조로 운영될 수 있습니다.

유사한 도구

JetBrains Mellum 2 대 경쟁사

JetBrains Mellum 2는 광범위한 범용 LLM을 직접 대체하기보다는 더 큰 AI 시스템 내에서 빠르고 특화된 구성 요소 역할을 하도록 설계된 '초점 모델'로 자리매김하고 있습니다. 그 Mixture-of-Experts (MoE) 아키텍처는 효율성과 속도 이점을 제공하여 프로덕션 환경에서 고주파, 지연 시간에 민감한 작업에 적합합니다. 이는 다양한 도메인에 걸쳐 포괄적인 기능을 목표로 하는 더 일반화된 코딩 비서와 대조됩니다.

1

Integrates deeply with GitHub and major IDEs, offering AI-powered code suggestions, chat, and agentic workflows.

Unlike Mellum 2's open-weight model, Copilot uses proprietary models (OpenAI, Claude, Microsoft) and has a more established ecosystem with GitHub. It offers a freemium model, with a free tier for basic completions and paid tiers for advanced features and higher usage.

2

Deeply integrated with AWS services, providing specialized code suggestions, security scans, and autonomous agents for AWS-centric development.

Similar to Mellum 2, it offers a freemium model for individuals. While Mellum 2 is a general software engineering model, CodeWhisperer/Q Developer is particularly optimized for AWS APIs and infrastructure.

3

Emphasizes privacy and control with options for on-premises, VPC, or air-gapped deployments, and the ability to train on private codebases.

Tabnine is a pioneer in AI code completion and offers a freemium model like Mellum 2. Its focus on enterprise-grade privacy and customization, including BYOL (Bring Your Own LLM) and training on private repos, differentiates it from Mellum 2's open-weight model.

4
Code Llama (Meta)

An open-weight large language model family specifically designed for code generation, completion, and discussion, built on Llama 2.

Code Llama is an open-weight model, similar to Mellum 2's open-weight nature, but it is a foundational model rather than a direct end-user tool with a freemium offering. It is free for research and commercial use (with some exceptions for very large companies), which differs from Mellum 2's freemium product offering.

연결
𝕏
X / Twitter@arxiv