오픈 가중치 멀티모달 모델 Agnes-3.0-Flash 공개 — AI 생성 일러스트AI 일러스트
모델 뉴스

오픈 가중치 멀티모달 모델 Agnes-3.0-Flash 공개

Agnes-AI/Agnes-3.0-Flash

Hugging Face발표일 미상 · 3분

Agnes AI가 오픈 가중치(Open Weights) 기반의 멀티모달 모델 'Agnes-3.0-Flash Preview'를 공개했습니다. 텍스트, 이미지, 비디오 등 다양한 형태의 입력을 처리할 수 있는 것이 특징입니다.

세 줄 요약Hugging Face 원문 기반
  1. 최대 262,144 토큰에 달하는 긴 컨텍스트 창을 지원하며, 하이브리드 어텐션 구조와 향상된 추론 능력을 통해 코딩 및 복합 작업에서 높은 성능을 보여줍니다.
  2. 최신 플래그십 모델에 버금가는 강력한 AI 기능을 제공하지만, 접근성이 높아 고가 장비 없이도 고급 인공지능 활용을 원하는 개발자에게 큰 도움이 될 전망입니다.
  3. 다만, 본 모델은 'Preview' 공개본이며 공식 API 버전과 구별되어야 합니다. 제시된 모든 성능 지표와 벤치마크 결과는 오픈 가중치 체크포인트 기준임을 반드시 유의해야 합니다.

Agnes-3.0-Flash Preview는 오픈 기반의 프리뷰 모델로 소개되었다. 이 모델은 33B 를 가지며 이 262,144 에 달한다. 개발자들은 이 버전이 텍스트, 이미지, 비디오 이해를 지원하며 조정 가능한 추론 노력을 통해 플래그십급 성능을 제공한다고 설명했다. 다만, 본 모델은 공식 의 프로덕션 체크포인트와는 별개이며, 제시된 모든 성능 지표는 오픈 가중치 프리뷰 버전을 기준으로 한다.

기술적 아키텍처 측면에서 Agnes-3.0-Flash Preview는 하이브리드 어텐서 디코더를 채택했다. 총 72개의 레이어 중 3분의 2가 게이티드 델타 규칙을 사용하고, 나머지 4분의 1은 표준 글로벌 어텐션을 수행하는 구조이다. 이 모델의 비전 타워는 27개 레이어로 구성되어 있으며, 컨텍스트 길이는 최대 262,144 토큰으로 설정되었다.

사용자들은 `transformers>=5.12` 라이브러리를 설치하고, 모델 로딩 시 반드시 `trust_remote_code=True`를 지정해야 한다. 특히 이미지나 비디오와 같은 멀티모달 입력을 처리할 때는 전용 프로세서를 사용하여 입력 데이터를 준비하는 과정이 필요하다.

용어 풀이

가중치
학습으로 정해진 모델 내부의 숫자 값. 내려받는 모델 파일의 본체예요.
멀티모달
글뿐 아니라 이미지·음성·영상처럼 여러 형태의 입력을 함께 다루는 것.
파라미터
모델이 학습하면서 조정한 내부 숫자. 개수가 많을수록 대체로 모델이 크고 무거워요.
컨텍스트 창
모델이 한 번에 읽고 참고할 수 있는 입력의 최대 길이. 보통 토큰 수로 나타내요.
토큰
AI 모델이 글을 처리하는 단위. 단어보다 작은 조각이며 사용량과 요금을 셀 때 기준이 돼요.
API
프로그램끼리 기능을 주고받는 약속된 창구. AI 모델은 보통 API로 불러 써요.
원문Hugging Face · Agnes-AI/Agnes-3.0-Flash같은 주제 가이드 · 바로 써 보기내 업무 예시로 AI 모델 비교하기

평일 아침 메일로 받아 보기 ›틀린 곳 알리기