메타가 에이전트 워크플로우와 코딩 성능을 강화한 '뮤즈 스파크 1.3'을 공개했다. 아티피셜 애널리시스 종합지능지수(AAII) 평가에서 맥스 모드 기준 62점으로 오픈AI 주요 모델들을 제치고 전체 3위에 올랐으며, 누구나 쓸 수 있는 기본 배포 버전(xhigh)은 61점으로 GPT-5.6 솔·그록 4.6과 공동 5위를 기록했다. 코딩 벤치마크 '딥SWE v1.1'에서 75.4점으로 클로드 오퍼스 5(74점)와 GPT-5.6 솔(73점)을 앞섰고, 작업당 비용은 0.55달러로 61점 이상 모델 중 가장 저렴한 가성비를 보였다. 메타는 앞으로 대형 모델과 오픈 웨이트 버전도 순차 공개할 계획이다.
- •메타 뮤즈 스파크 1.3(맥스)은 AAII 62점으로 오픈AI 주요 모델을 제치고 전체 3위에 올랐다.
- •기본 배포 버전(xhigh)은 61점으로 GPT-5.6 솔·그록 4.6과 공동 5위를 기록했다.
- •딛SWE v1.1 코딩 벤치마크에서 75.4점으로 오퍼스 5·GPT-5.6 솔을 앞셀다.
- •작업당 비용 0.55달러로 동급 성능 모델 중 최대 55% 이상 저렴한 가성비를 보였다.
0단 자동
AI가 규칙대로 쓰고 그대로 게시했습니다. 사람이 따로 보지 않았습니다.
- 규칙 판
- 규칙 판 도입 이전 기사입니다.
- 남기는 것
- 규칙 판 · 모델 · 시각
- 판 기록
- 아직 없습니다.
메타, '뮤즈 스파크 1.3' 출시...오픈AI 제치고 세계 3위 성능

- 1.메타, '뮤즈 스파크 1.3' 공개, AAII에서 오픈AI 제치고 세계 3위(62점)
- 2.기본 배포판 xhigh는 61점으로 GPT-5.6·그록 4.6과 공동 5위, 맥스는 일부 파트너 미리보기
- 3.딥SWE v1.1에서 75.4점으로 오퍼스 5(74점)·GPT-5.6 솔(73점) 상회, 작업당 0.55달러로 동급 최저가
- 4.MRCR 256K~512K에서 98.5점, 도구호출 20%·토큰생성 25% 감축해 효율성도 개선
왜 중요한가?
벤치마크 점수뿐 아니라 작업당 비용까지 오픈AI·앤트로픽 상위권 모델을 앞선다는 점은, 프론티어 모델 경쟁의 축이 '최고 성능'에서 '성능 대비 비용 효율'로 옮겨가고 있음을 보여준다.
언급 프로젝트
메타의 '뮤즈 스파크 1.3'이 에이전트 워크플로우와 코딩 성능을 강화하며 종합 지능 지수에서 세계 3위에 등극한 것은 매우 고무적입니다. 이는 국내 LLM 개발사 및 기업들이 글로벌 경쟁 속에서 AI 에이전트와 코드 생성 능력 강화의 중요성을 인지하고 기술 발전에 박차를 가해야 할 신호로 해석됩니다.
본문 미리보기
메타가 에이전트 워크플로우와 코딩 성능을 대폭 강화한 '뮤즈 스파크 1.3(Muse Spark 1.3)'을 공개했다. 이 모델은 아티피셜 애널리시스(Artificial Analysis)의 종합 지능 지수 평가에서 오픈AI의 대표 모델들을 제치고 세계 3위에 올라서며 주목받고 있다.메타는 2일(현지시간) 플래그십 모델 뮤즈 스파크 1.3을 발표하고, '뮤즈 코드(Muse Code)' 및 메타 모델 API에 배포했다고 밝혔다. 뮤즈 스파크는 지난 4월 8일 첫 선을 보인 이후 5개월 동안 4번째 버전을 내놓을 정도로 빠른 개발 속도를
전체 내용이 궁금하다면?
원문을 직접 읽어보세요
이 글이 만들어진 과정
- 11:24AI 초안
![[AI리더의 서가] Agentic AI 구축 개발의 모든 것](https://cdn.aitimes.com/news/photo/202610/215958_219938_244.jpg)
