메타가 5개월 만에 네 번째 모델인 '뮤즈 스파크 1.3'을 공개하며 xhigh 등급을 우선 출시했다. Artificial Analysis 지능지수에서 max 62점, xhigh 61점을 기록해 7월 53점, 8월 57점에서 상승했으며, 특히 에이전트형 벤치마크인 τ³-Bench 뱅킹에서 max가 52%로 업계 1위를 차지했다. 다만 터미널 코딩 테스트에서는 Claude Fable 5.1이 91.4%로 여전히 앞서며, 다른 벤치마크에서도 최상위권에는 미치지 못한다. 가장 큰 강점은 가격으로, 인덱스 작업당 0.55달러에 불과해 59점 이상 모델 중 가장 저렴하며, 오픈웨이트 버전도 출시될 예정이다.
- •메타가 5개월간 네 번째 모델인 '미즈 스파크 1.3'을 공개했으며 xhigh 등급이 우선 제공된다.
- •지능지수에서 max 62점, xhigh 61점으로 전월 대비 상승했지만 최상위 모델에는 못 미친다.
- •에이전트형 뱅킹 벤치마크(τ³-Bench)에서 max가 52%로 현재 업계 1위를 기록했다.
- •터미널 코딩 테스트에서는 Claude Fable 5.1이 91.4%로 여전히 앞선다.
- •인덱스 작업당 0.55달러로 동급 모델 중 가장 저렴하며 오픈웨이트 버전도 예정돼 있다.
0단 자동
AI가 규칙대로 쓰고 그대로 게시했습니다. 사람이 따로 보지 않았습니다.
- 규칙 판
- 규칙 판 도입 이전 기사입니다.
- 남기는 것
- 규칙 판 · 모델 · 시각
- 판 기록
- 아직 없습니다.
Meta closes in on the top with Muse Spark 1.3, and undercuts rivals on price

본문 미리보기
Meta has released Muse Spark 1.3, its fourth model in the series in five months. According to Artificial Analysis, the model gains the most on agentic benchmarks but still trails Claude Fable 5.1 and other top models. The strongest argument is price. At $0.55 per task, Muse Spark undercuts every comparably scored rival. The article Meta closes in on the top with Muse Spark 1.3, and undercuts rivals on price appeared first on The Decoder.
전체 내용이 궁금하다면?
원문을 직접 읽어보세요
이 글이 만들어진 과정
- 10:33AI 초안
![[AI리더의 서가] Agentic AI 구축 개발의 모든 것](https://cdn.aitimes.com/news/photo/202610/215958_219938_244.jpg)
