구글이 Gemini 3.7 Flash, 3.6 Flash, 3.5 Flash-Lite 모델 전반에 '에이전틱 비디오 이해' 기능을 새로 도입했다. 고정 프레임률로 영상을 처리하던 기존 방식과 달리, 모델이 목표에 따라 영상 프레임·오디오·자막을 능동적으로 탐색해 필요한 구간만 확인함으로써 토큰 사용량을 최대 88%, 비용을 최대 66% 줄이면서 정확도는 최대 7% 높였다. 10분 분량의 가이드 영상부터 90분 강의, 다중 시간 녹화물 등 긴 영상에서 효과가 두드러지며, 초 단위 순간 검색, 이상 탐지, 정밀 카운팅 등에 활용된다. 구글 AI 스튜디오와 Gemini Enterprise Agent Platform에서 API 설정을 'agentic'으로 바꾸면 즉시 사용할 수 있으며, 향후 유튜브의 'Ask YouTube' 기능에도 적용될 예정이다.
- •Gemini 3.7/3.6 Flash, 3.5 Flash-Lite에 에이전틱 비디오 이해 기능 출시
- •긴 영상 분석에서 토큰 사용량 최대 88%, 비용 최대 66% 절감, 정확도 최대 7% 향상
- •고정 프레임 처리 대신 목표 지향적으로 프레임·오디오·자막을 동적 탐색
- •초 단위 순간 검색, 이상 탐지, 반복 동작 카운팅 등에 활용
- •추가 기능 요금 없이 API 설정만으로 활성화, 향후 유튜브 'Ask YouTube'에도 적용 예정
0단 자동
AI가 규칙대로 쓰고 그대로 게시했습니다. 사람이 따로 보지 않았습니다.
- 규칙 판
- 규칙 판 도입 이전 기사입니다.
- 남기는 것
- 규칙 판 · 모델 · 시각
- 판 기록
- 아직 없습니다.
Introducing agentic video understanding with Gemini
- 1.구글, 제미나이 3.7/3.6 Flash·3.5 Flash-Lite에 '에이전틱 비디오 이해' 기능 출시
- 2.고정 프레임레이트 대신 모델이 스스로 영상 구간·오디오·자막을 탐색해 필요 부분만 분석
- 3.토큰 소비 최대 88%↓, 분석 비용 최대 66%↓, 정확도 최대 7%↑
- 4.AI Studio·엔터프라이즈 플랫폼에서 즉시 사용 가능, 유튜브에도 적용 예정
왜 중요한가?
장시간 영상 분석에서 정확도와 비용 중 하나를 포기해야 했던 기존 고정 프레임 처리의 한계를 에이전틱 접근으로 동시에 개선해, 실시간 이상탐지·순간검색 등 장편 영상 활용의 상용화 문턱을 낮춘다.
전체 내용이 궁금하다면?
원문을 직접 읽어보세요
이 글이 만들어진 과정
- 10:11AI 초안
![[AI리더의 서가] Agentic AI 구축 개발의 모든 것](https://cdn.aitimes.com/news/photo/202610/215958_219938_244.jpg)
