알리바바 클라우드가 영상 생성 모델 '완3.0' 베타를 지난 7일 공개하고 공개 테스트에 들어갔다. 최대 생성 길이를 기존 완2.7의 15초에서 두 배인 30초로 늘렸고, 텍스트·이미지·영상·음성뿐 아니라 웹페이지·PDF·PPT까지 입력받아 영상으로 전환하는 '문서-투-비디오' 기능을 새로 지원한다. 인물·제품의 외형과 음성 일관성을 유지하는 성능을 개선해 시각적 드리프트 문제를 줄였으며, 자율주행·로봇 학습용 시뮬레이션 영상 생성에도 활용 가능하다고 밝혔다. 알리바바는 모델 스튜디오와 큐웬 클라우드를 통해 피드백을 수집하며 성능을 지속 개선할 계획이다.
- •알리바바 완3.0 베타 공개, 최대 영상 생성 길이 15초→30초로 두 배 확대
- •텍스트·이미지·영상·음성뿐 아니라 PDF·PPT·웹페이지까지 입력받는 '문서-투-비디오' 기능 도입
- •인물·제품·음성의 장면 간 일관성을 강화해 시각적 드리프트 문제 개선
- •자율주행·로봇 학습용 시뮬레이션 영상 생성 등 피지컬 AI 데이터로 활용 확대 가능
0단 자동
AI가 규칙대로 쓰고 그대로 게시했습니다. 사람이 따로 보지 않았습니다.
- 규칙 판
- 규칙 판 도입 이전 기사입니다.
- 남기는 것
- 규칙 판 · 모델 · 시각
- 판 기록
- 아직 없습니다.
[AI 리뷰] “AI 영상 생성, 이젠 30초”…알리바바, 멀티모달 입력 지원 ‘완3.0’ 공개
본문 미리보기
알리바바 클라우드(Alibaba Cloud)는 지난 7일(현지시간) 영상 생성 모델 ‘완3.0(Wan3.0)’ 베타 버전을 공개하고 공개 테스트에 들어갔다.완3.0의 가장 큰 특징은 영상 생성 길이를 기존 모델보다 두 배 늘린 최대 30초로 확대하고, 텍스트·이미지·영상·음성 등 다양한 형태의 입력을 하나의 모델에서 처리할 수 있도록 한 것이다.사용자는 알리바바 클라우드의 AI 개발 플랫폼 모델 스튜디오(Model Studio)와 AI 네이티브 클라우드 플랫폼 큐웬 클라우드(Qwen Cloud)를 통해 완3.0 테스트를 신청할
전체 내용이 궁금하다면?
원문을 직접 읽어보세요
이 글이 만들어진 과정
- 11:01AI 초안
