트웰브랩스가 엔터테인먼트·스포츠 분야에 적용해온 영상 이해 기술을 로봇 등 피지컬 AI 영역으로 확장한 비전언어모델 '페가수스 1.6'을 출시했다. 이 모델은 액션캠이나 스마트글래스로 촬영한 1인칭 '에고센트릭 데이터'를 이해하고 자동으로 라벨링하는 것이 특징이며, 행동 분할·상세 캡션·품질 평가·검색 및 큐레이션·개인정보 탐지 등 5가지 기능을 제공한다. 이를 통해 원본 영상 1시간당 약 155시간 걸리던 수작업 라벨링 부담을 자동화로 크게 줄일 수 있다고 회사는 설명했다. 현재 미국의 한 로보틱스 학습 데이터 기업에 적용돼 있으며, 트웰브랩스는 적용 범위를 점차 넓혀갈 계획이다.
- •트우레브랞스, 피지컬 AI용 비전언어모델 '페가수스 1.6' 출시
- •1인칭 '에고센트릭 데이터' 이해·자동 라벨링이 핵심 기능
- •행동 분할·캐턴·품질평가·검색·개인정보 탐지 등 5대 기능 제공
- •수작업 대비 영상 1시간당 약 155시간이던 라벨링 시간을 자동화로 대폭 단축
- •미국 로보틱스 학습데이터 기업에 적용, 누적 투자 3000억원 이상
0단 자동
AI가 규칙대로 쓰고 그대로 게시했습니다. 사람이 따로 보지 않았습니다.
- 규칙 판
- 규칙 판 도입 이전 기사입니다.
- 남기는 것
- 규칙 판 · 모델 · 시각
- 판 기록
- 아직 없습니다.
"1인칭 영상을 로봇 학습 데이터로"...트웰브랩스 '페가수스 1.6' 출시
- 1.트웰브랩스, 1인칭 영상 이해 VLM '페가수스 1.6' 출시…피지컬 AI 학습 데이터 자동 라벨링
- 2.행동 분할, 캡션 생성, 품질 평가, 검색·큐레이션, 개인정보 탐지 등 5대 기능 제공
- 3.영상 1시간당 155시간 걸리던 수작업 라벨링을 자동화해 로봇 학습 데이터 구축 부담 경감
- 4.미국 로보틱스 학습 데이터 기업에 이미 적용, 누적 투자 3000억원 이상 유치
왜 중요한가?
로봇 등 피지컬 AI 학습에 필요한 영상 데이터 라벨링을 자동화해 데이터 구축 병목을 해소하며, 영상 이해 기술이 엔터테인먼트를 넘어 로보틱스 산업으로 확장되는 흐름을 보여준다.
본문 미리보기
트웰브랩스가 엔터테인먼트, 스포츠, 공공 분야에 적용해온 영상 이해 기술을 로봇 등 피지컬 AI 분야로 확대한다.트웰브랩스는 피지컬 AI 학습 데이터 수집에 특화된 비전언어모델(VLM) '페가수스 1.6'을 출시했다고 밝혔다. 페가수스 1.6은 '에고센트릭 데이터(Egocentric Data)' 이해 및 라벨링 자동화가 특징이다.에고센트릭 데이터는 1인칭 영상 데이터를 말하는 것으로, 작업자가 액션캠이나 스마트 글래스를 착용한 채 특정 동작을 수행하는 모습을 촬영, 수집할 수 있다는 설명이다.여기에 ▲행동 분할 및 라벨링 ▲상세 캡
전체 내용이 궁금하다면?
원문을 직접 읽어보세요
이 글이 만들어진 과정
- 11:24AI 초안

