앤트로픽이 출시한 '클로드 페이블 5.1'은 아티피셜 애널리시스 종합지능지수(AAII)에서 66점으로 역대 최고를 기록하며 캐시 읽기 가격을 75% 인하했지만, 실제 작업당 비용은 이전 모델보다 20% 높은 3.76달러로 나타났다. 원인은 출력 토큰 사용량으로, 페이블 5.1은 더 높은 성능을 내기 위해 페이블 5보다 약 1.7배 많은 출력 토큰을 사용했고 출력 토큰 단가가 입력·캐시보다 훨씬 높기 때문이다. 아티피셜 애널리시스는 최대 추론(Max) 대신 '높음(High)' 설정을 쓰면 성능은 65점으로 1점만 낮아지지만 비용은 2.72달러로 28% 절감되는 '파레토 프론티어'를 제시했다. 이는 AI 모델 경쟁이 벤치마크 점수뿐 아니라 토큰 사용 효율까지 함께 따지는 방향으로 이동하고 있음을 보여준다.
- •클로드 페이블 5.1은 AAII 66점으로 역대 최고 성능을 기록하며 캐시 읽기 가격을 75% 낮쳤다.
- •그러나 출력 토큰 사용량이 1.7배 늘면서 실제 작업당 비용은 오히려 20% 상승한 3.76달러를 기록했다.
- •최대 추론(Max) 대신 '높음(High)' 설정을 쓰면 성능은 1점만 낮아지고 비용은 28% 절감된다.
- •AI 모델 경쟁의 기준이 벤치마크 점수에서 토큰 사용 효율(가격×사용량)로 이동하고 있다.
0단 자동
AI가 규칙대로 쓰고 그대로 게시했습니다. 사람이 따로 보지 않았습니다.
- 규칙 판
- 규칙 판 도입 이전 기사입니다.
- 남기는 것
- 규칙 판 · 모델 · 시각
- 판 기록
- 아직 없습니다.
[9월2일] 캐시 가격 75% 내렸는데 비용은 20% 올랐다…페이블 5.1의 ‘토큰 역설’
![[9월2일] 캐시 가격 75% 내렸는데 비용은 20% 올랐다…페이블 5.1의 ‘토큰 역설’](https://cdn.aitimes.com/news/photo/202609/214733_218445_269.png)
- 1.앤트로픽 '페이블 5.1', AAII 66점으로 역대 최고, 캐시 읽기 가격 75% 인하(1달러→0.25달러)
- 2.출력 토큰을 페이블 5 대비 약 1.7배 더 사용해 작업당 실제 비용은 오히려 20% 상승(3.14→3.76달러)
- 3.맥스(66점·3.76달러) 대비 하이(65점·2.72달러)는 성능 1점에 비용 28%를 더 내야 하는 구조
- 4.비용 경쟁력 기준이 '토큰당 가격'에서 '토큰 가격×사용량'으로 이동, GPT-5.6 솔도 비용·효율 강조
왜 중요한가?
캐시 가격 인하가 실제 비용 절감으로 직결되지 않는다는 사례는, 추론형 모델 선택 시 절대 성능보다 '노력(Effort)' 설정별 비용 대비 효율을 따져야 한다는 실무적 판단 기준을 제시한다.
앤트로픽 클로드 페이블 5.1에서 나타난 '토큰 역설'은 캐시 가격 인하에도 불구하고 실제 작업당 비용이 증가할 수 있음을 보여줍니다. 이는 국내 기업들이 LLM 도입 시 단순히 표면적인 가격 할인이 아닌, 실제 운영 비용과 효율성을 면밀히 분석하여 비용 최적화 전략을 수립해야 함을 시사합니다.
본문 미리보기
앤트로픽이 1일(현지시간) 출시한 ‘클로드 페이블 5.1’은 아티피셜 애널리시스 종합 지능 지수(AAII)에서 66점을 기록하며 역대 최고 성능에 올랐습니다. 특히 그동안 타사에 비해 비싸다는 평가를 받던 캐시 읽기 가격을 75% 낮춰 눈길을 끌었습니다.그런데 가격 구조를 들여다보면 흥미로운 점이 나타납니다. 캐시 읽기 가격을 75%나 낮췄지만, 실제 작업당 비용은 이전 모델보다 오히려 20% 높아졌습니다.페이블 5.1은 최대 노력(Max) 설정에서 AAII 66점을 기록해 페이블 5(62점), 클로드 오퍼스 5(63점), GPT-
전체 내용이 궁금하다면?
원문을 직접 읽어보세요
이 글이 만들어진 과정
- 11:24AI 초안
![[AI리더의 서가] Agentic AI 구축 개발의 모든 것](https://cdn.aitimes.com/news/photo/202610/215958_219938_244.jpg)
