UAE 기술혁신연구소(TII)가 아랍어, 특히 에미라티 방언에 중점을 둔 16억 파라미터 음성인식 모델 Falcon-ASR을 공개했다. 영어, 프랑스어, 스페인어, 포르투갈어도 함께 지원하며, 6개 아랍어 테스트셋 평균 단어오류율(WER) 20.92%로 비교한 리더보드 최고 공개 성적인 23.17%보다 2.25%포인트 개선됐다. 내부 에미라티 평가에서는 WER 22.73%, CER 10.19%를 기록해 비교 대상 중 가장 낮은 오류율을 보였으며, 다음으로 좋은 Qwen3-Omni보다 WER이 4.07%포인트 낮았다. 배경 잡음, 중첩 발화, 음악, 실내 반향, 통화 음질, 속도·음고 변화 등 다양한 녹음 조건으로 학습했고, 영어 7개 공개 테스트셋에서는 평균 WER 5.74%를 달성했다. 단어 단위 타임스탬프도 지원하며, 5개 언어 모두 언어 플래그 없이 하나의 모델 가중치로 처리된다.
- •TII가 에미라티 방언 중심의 16억 파라미터 아랍어 음성인식 모델 Falcon-ASR 공개
- •6개 아랍어 테스트셋 평균 WER 20.92%로 기존 최고 공개 성적보다 2.25%포인트 개선
- •내부 에미라티 평가에서 WER 22.73%, CER 10.19%로 비교 시스템 중 최저 오류율, Qwen3-Omni보다 4.07%포인트 우위
- •다양한 잡음·반향·통화 조건으로 학습, 영어 7개 공개 테스트셋 평균 WER 5.74%
- •영어·프랑스어·스페인어·포르투갈어까지 언어 플래그 없이 하나의 가중치로 처리, 단어 단위 타임스탬프 지원
0단 자동
AI가 규칙대로 쓰고 그대로 게시했습니다. 사람이 따로 보지 않았습니다.
- 규칙 판
- 규칙 판 도입 이전 기사입니다.
- 남기는 것
- 규칙 판 · 모델 · 시각
- 판 기록
- 아직 없습니다.
Introducing Falcon ASR
- 1.TII가 1.6B 파라미터 아랍어 음성인식 모델 'Falcon-ASR' 공개, 에미라티 방언 특화
- 2.6개 아랍어 테스트셋 평균 WER 20.92%, 기존 최고 23.17%보다 2.25%p 개선
- 3.자체 에미라티 평가 WER 22.73%·CER 10.19%로 최저, Qwen3-Omni보다 4.07%p 낮음
- 4.영·불·서·포르투갈어도 동일 가중치 지원, 영어 7개 테스트셋 평균 WER 5.74%
왜 중요한가?
표준 아랍어 대비 학습 자원이 부족한 에미라티 등 걸프 방언 음성인식에서 공개 최고 성능을 달성해, 회의·전화 상담 등 리소스가 부족한 방언 음성 서비스에 바로 쓸 수 있는 오픈 모델 선택지를 넓힌다.
전체 내용이 궁금하다면?
원문을 직접 읽어보세요
이 글이 만들어진 과정
- 10:39AI 초안



![[Tech Insight] "AI 해킹, 보안 문제로만 보는 건 위험한 착각"](https://cdn.digitaltoday.co.kr/news/photo/202610/706229_653947_485.jpg)