구글이 6주 만에 세 번째 보급형 모델인 '제미나이 3.8 플래시'를 범용 추론·코딩 버전과 사이버보안 특화 버전 '3.8 플래시 사이버' 두 가지로 출시했다. 3.8 플래시는 장기 소프트웨어 엔지니어링 벤치마크 DeepSWE v1.1에서 73.7%를 기록해 클로드 오퍼스 5(74.0%)에 근접하고 GPT-5.6 솔(72.7%), 이전 3.7 플래시(65.3%)를 앞섰으며, 입력 100만 토큰당 0.75달러로 오퍼스5(5달러)나 GPT-5.6 솔(4달러)보다 훨씬 저렴하다. 다만 복잡한 작업에서 추론 단계를 더 거치고 도구를 반복 호출해 토큰 소비가 늘면서 작업당 비용은 3.7 대비 약 40% 상승했다. 사이버보안 특화판인 3.8 플래시 사이버는 정부기관·핵심 인프라 운영자 등에게만 제한 배포되며, 취약점 탐지 벤치마크 CyberGym에서 86.2%로 GPT-5.6 솔(83.6%)을 앞섰고 프롬프트 주입 공격 방어력에서도 공격 성공률 5.5%로 상위권을 기록했다.
- •6주 새 세 번째 플래시 모델, 범용판과 사이버보안 특화판 '3.8 플래시 사이버' 동시 출시
- •DeepSWE v1.1 코딩 벤치마크 73.7%로 오퍼스5(74.0%)에 근접, GPT-5.6 솔·3.7 플래시 상회
- •입력 100만 토큰당 0.75달러로 경쟁 프론티어 모델 대비 훨씬 저렴하나, 추론 단계 증가로 작업당 비용은 3.7 대비 약 40% 상승
- •사이버보안판은 정부·핵심 인프라 기관에 제한 배포, CyberGym 취약점 탐지 86.2%로 경쟁 모델 상회
- •프롬프트 주입 공격 방어 벤치마크에서 공격 성공률 5.5%로 클로드 오퍼스5(4.8%) 다음으로 우수
0단 자동
AI가 규칙대로 쓰고 그대로 게시했습니다. 사람이 따로 보지 않았습니다.
- 규칙 판
- 규칙 판 도입 이전 기사입니다.
- 남기는 것
- 규칙 판 · 모델 · 시각
- 판 기록
- 아직 없습니다.
Gemini 3.8 Flash is Google's third budget model in six weeks while frontier models remain MIA
본문 미리보기
Google's Gemini 3.8 Flash, the third Flash model in six weeks, matches Claude Opus 5 on some agentic coding benchmarks at lower cost. But its "working harder" reasoning burns about 30 percent more output tokens per task, making it pricier in practice than its predecessor despite identical token rates. The article Gemini 3.8 Flash is Google's third budget model in six weeks while frontier models remain MIA appeared first on The Decoder.
전체 내용이 궁금하다면?
원문을 직접 읽어보세요
이 글이 만들어진 과정
- 10:33AI 초안
![[AI리더의 서가] Agentic AI 구축 개발의 모든 것](https://cdn.aitimes.com/news/photo/202610/215958_219938_244.jpg)
