JetBrains, 저장소 탐색·수정·검증용 오픈 모델 Mellum2.1 공개
JetBrains가 코딩 에이전트용 Mellum2.1을 Apache 2.0으로 공개했다. 전체 120억·활성 25억 파라미터 구조를 유지하면서 실제 환경의 강화학습으로 저장소 탐색·파일 수정·변경 검증 능력을 높였다는 설명이다. Hugging Face에서 제공하며, GGUF 빌드와 vLLM용 다중 토큰 예측 헤드는 곧 공개할 예정이다.
6월 공개한 Mellum2의 후속 버전으로, 모델 구조는 유지하고 사후학습에 집중했다.
회사에 따르면 수천 개 환경에서 수백만 회의 샌드박스 실행을 통해 강화학습했다.
수학·경쟁 프로그래밍·과학·도구 사용·소프트웨어 공학 과제를 추가하고, 깨진 테스트나 검증 불가능한 정답 등을 걸러냈다.
JetBrains는 동일 평가 설정에서 Mellum2·Qwen3.5-9B·Gemma 4 E4B와 비교했으며 에이전트 코딩에서 가장 큰 개선을 보였다고 밝혔다.
회사 측 비교에서 고부하 처리량은 Qwen3.5-9B의 거의 2배였고, 단일 요청에서는 다중 토큰 예측으로 약 1.6배 빨라졌다고 설명했다.
llama.cpp·Ollama·LM Studio용 GGUF와 vLLM의 추측 디코딩용 MTP 헤드는 향후 제공 예정이다.
자체 인프라의 코딩 에이전트에서 실패한 테스트의 원인 탐색과 수정안 작성·검증을 맡기는 하위 에이전트로 활용할 수 있다.
원문
- Mellum2.1 Gets to Work: A Fast Open Model for Coding AgentsJetBrains · 원문 2026-10-08