Mistral, Large 4 학습에 자체 NVIDIA GPU 4000개 사용했다고 밝혀
Mistral의 Pierre Stock 과학 부사장은 TechCrunch에 Large 4를 자체 연산 자원인 NVIDIA GPU 4000개로 학습했다고 밝혔다. 중국 경쟁사보다 GPU 수가 2~3배 적다는 회사 설명이다. 사이버보안·금융·칩 설계를 최적화 대상으로 꼽았으며, 가중치 공개 전 협력사·정부와 안전성 검토를 진행할 계획이다.
GPU 수는 회사가 밝힌 학습 인프라 규모다. 기사에는 학습 기간·GPU 모델·총 연산량이나 비용 비교가 제시되지 않았다.
Stock은 칩 설계를 주요 활용 분야로 제시했다. Mistral의 투자사에는 ASML과 Samsung이 포함된다.
현재 공개 접근은 안전장치가 적용된 엔드포인트로 제한되며, 회사는 안전성 시험을 마친 뒤 약 3주 후 가중치를 공개할 계획이라고 설명했다.
협력사·정부와 가중치가 방어에 활용되고 악성 공격에는 쓰이지 않도록 검토하겠다는 구상이다.
원문
- Mistral’s new 1T model aims to leapfrog closed and open rivalsTechCrunch AI · 원문 2026-10-06