미스트랄, 초대형 멀티모달 모델 'ML4' 공개 및 성능 입증
Mistral Large 4: "Le Chonk"
Hacker News미스트랄이 최대 1조 개의 파라미터를 가진 초대형 멀티모달 모델 '미스트랄 라지 4'의 공개 프리뷰를 시작했습니다.
이 모델은 유럽 법률을 준수하며 기업이 외부 의존 없이 자체적으로 운영할 수 있는 초대형 AI 시스템 구축에 중요한 기반을 제공해요.
- 사이버 보안, 금융, 법률 등 전문 영역에서 최고 수준의 성능을 입증했으며, 폐쇄형 상용 모델도 어려워하는 복잡한 업무 수행 능력을 갖췄습니다.
- 유럽 데이터센터 기반으로 운영되며 유럽 법률을 준수하는 것이 특징입니다. 이는 기업이 외부 의존 없이 자율적인 AI 시스템을 구축할 수 있게 합니다.
- 현재는 API 프리뷰로 제공되며, 모델 가중치는 이달 말 공개 예정입니다. 사용자들은 실제 환경에서의 성능 검증과 추가 정보를 주목해야 합니다.
미스트랄은 1조 개의 를 가진 네이티브 모델인 ML4의 공개 프리뷰를 시작했다고 발표했습니다. ML4는 현재까지 가장 크고 강력한 모델로, 코딩, 워크플로우, 그리고 멀티모달 이해 전반에서 뛰어난 성능을 보여줍니다. 특히 사이버 보안, 금융, 법률 등 핵심 기업 업무 영역에서 최고 수준의 성능을 입증했으며, 일부 도메인에서는 최첨단 폐쇄형 모델을 능가하는 것으로 나타났습니다.
ML4는 유럽 데이터센터에서 3,800개의 NVIDIA Grace Blackwell 를 사용해 처음부터 학습되었으며, 유럽 법률에 따라 운영되는 것이 특징입니다. 이는 기업이 외부 서비스 제공업체에 의존하지 않고 자율적인 AI 시스템을 구축할 수 있도록 지원합니다. 특히 사이버 보안 분야에서는 제공업체 수준의 거부(refusals)가 민감한 취약점 연구를 막는 것을 방지하며, ML4는 오픈 와 자체 배포 기능을 결합하여 높은 자율성을 제공합니다.
현재 사용자는 Mistral Studio에서 프리뷰 를 통해 모델을 체험할 수 있으며, 모델 가중치는 이달 말에 공개될 예정입니다. 성능 면에서는 사이버 보안 분야의 독립 평가 지표(Artificial Analysis Cyber Index)에서 상위 5개 모델 중 하나로 평가받았고, 오픈 소스 모델 중 최고 점수를 기록했습니다. 또한 코딩 에이전트 지수에서도 높은 점수를 달성하며 복잡한 기술 워크플로우 전반에 걸쳐 강력함을 입증했습니다.
용어 풀이
- 파라미터
- 모델이 학습하면서 조정한 내부 숫자. 개수가 많을수록 대체로 모델이 크고 무거워요.
- 멀티모달
- 글뿐 아니라 이미지·음성·영상처럼 여러 형태의 입력을 함께 다루는 것.
- 에이전트
- 목표를 받으면 스스로 계획을 세우고 도구를 써서 여러 단계의 작업을 해내는 AI.
- GPU
- 많은 계산을 한꺼번에 처리하는 칩. AI 학습과 실행에 가장 많이 써요.
- 가중치
- 학습으로 정해진 모델 내부의 숫자 값. 내려받는 모델 파일의 본체예요.
- API
- 프로그램끼리 기능을 주고받는 약속된 창구. AI 모델은 보통 API로 불러 써요.
어떤 전문 분야에서 특히 뛰어난 성능을 보여주나요?
사이버 보안, 금융, 법률 등 핵심 기업 업무 영역에서 최고 수준의 성능을 입증했어요. 일부 도메인에서는 최첨단 폐쇄형 모델보다 나은 것으로 나타났고, 코딩 에이전트 지수에서도 높은 점수를 받았어요.
외부 서비스에 의존하지 않고 AI 시스템을 구축할 수 있나요?
네, 이 모델은 유럽 데이터센터에서 학습되었고 유럽 법률에 따라 운영되기 때문에 기업이 외부 서비스 제공업체에 의존하지 않고 자율적인 AI 시스템을 구축하는 데 도움을 줘요. 오픈 가중치와 자체 배포 기능을 결합하여 높은 자율성을 확보했어요.
현재 이 모델을 어떻게 체험해 볼 수 있나요?
현재는 Mistral Studio에서 프리뷰 API를 통해 모델을 체험할 수 있어요. 다만, 모델 가중치는 이달 말에 공개될 예정이에요.