구글이 '제미나이 4 아르곤'을 공개하며 18개 벤치마크 중 12개 단독 1위, 1개 공동 1위를 차지해 성능 선두를 탈환했지만, 페어윈드 프로그램 참여자와 미 정부 평가 참가자에게만 우선 접근을 허용하는 제한적 출시에 그쳤다. 장기 소프트웨어 엔지니어링 평가 딥SWE v1.1에서 77.9%로 클로드 오퍼스 5.5(74.2%)와 GPT-6 아스트라(74.1%)를 앞섰고, 프롬프트 주입 공격 방어 평가에서도 공격 성공률 0.7%로 경쟁 모델을 크게 앞질렀다. 다만 독립 평가기관 아티피셜 애널리시스의 종합 지능지수에서는 GPT-6 아스트라와 공동 3위에 그쳤는데, 이는 할인 가격 기준 비용의 60% 수준으로 동률 성능을 낸 '가성비' 성과로 해석된다. API 가격은 입력 100만 토큰당 2달러로 GPT-6 아스트라의 5분의 1 수준이다.
- •18개 벤치마크 중 12개 단독 1위·1개 공동 1위로 선데 탈환, 단 초기엔 페어윈드·美정벀에만 제한 개방
- •딥SWE v1.1 77.9%로 클로드 오퍼스 5.5·GPT-6 아스트럼띬 추월, 기릏즈전 거격성글율 0.7%로 최고 안전성
- •아단으솤 애닐리시스 종합 지릥지수에서는 GPT-6 아스트럼와 공동 3위, 수학·크분할제어는 열세
- •API 가거 입력 100만토큰당 2달러로 GPT-6 아스트럼의 5롱의 1, 클로드 오퍼스 5.5의 반
0단 자동
AI가 규칙대로 쓰고 그대로 게시했습니다. 사람이 따로 보지 않았습니다.
- 규칙 판
- 규칙 판 도입 이전 기사입니다.
- 남기는 것
- 규칙 판 · 모델 · 시각
- 판 기록
- 아직 없습니다.
구글, '제미나이 4 아르곤' 공개…성능 1위 탈환에도 "일반 사용 제한"

- 1.구글, 프런티어 모델 '제미나이 4 아르곤' 공개, 18개 벤치마크 중 13개 부문 1위 차지
- 2.출력토큰 한도 6만4000→100만으로 확장, 딥SWE v1.1 77.9%로 경쟁 모델들 추월
- 3.그레이스완 프롬프트주입 방어 평가 공격성공률 0.7%로 GPT-6 아스트라(8.5%) 대비 우수
- 4.'페어윈드' 프로그램 통해 보안파트너·美정부 평가참여자에만 우선 공개, 일반 API는 추후 배포
왜 중요한가?
성능은 최고 수준이지만 사이버보안·안전성 검증을 이유로 접근을 제한하는 단계적 출시 전략을 택해, 프론티어 모델 경쟁이 성능뿐 아니라 안전한 공개 방식 경쟁으로도 번지고 있음을 보여준다.
본문 미리보기
구글이 프런티어급 지능과 에이전트 작업 능력을 대폭 끌어올린 차세대 플래그십 모델 '제미나이 4 아르곤(Gemini 4 Argon)'을 공개했다. 핵심 경쟁 모델들을 제치고 벤치마크 선두를 탈환했음에도 불구하고, 대다수 개발자와 기업이 당장 사용할 수 없는 '제한적 출시'에 그쳤다. 구글은 30일(현지시간) 제미나이 4 아르곤을 소개하며 '페어윈드(Fairwind)' 프로그램을 통해 사전 검증된 사이버 보안 방어 파트너 및 미국 정부의 출시 전 평가 프로세스 참가자에게만 초기 접근 권한을 우선 부여했다. 구글 AI 울트라 구독자와
전체 내용이 궁금하다면?
원문을 직접 읽어보세요
이 글이 만들어진 과정
- 11:24AI 초안
