LiquidAI가 온디바이스에서 구동 가능한 자사 최고 성능 비전-언어 모델 LFM2.5-VL-3B를 공개했다. SigLIP2 400M NaFlex 비전 인코더와 LFM2.5-2.6B 텍스트 백본을 결합해 약 34조 토큰으로 사전학습했고, 이전 대비 4배 많은 비전 데이터와 128K로 두 배 늘린 어휘로 비라틴 문자 지원을 강화했다. 화면·UI 이해, 물체 그라운딩, 다중 이미지 입력, 함수 호출 네 가지 영역에서 성능을 개선했으며, MMStar·DocVQA·ChartQA 등 다수 벤치마크에서 동급 크기 모델(Gemma-4, InternVL 3.5, Qwen3.5)을 대체로 앞섰다. 추론 속도 면에서는 M5 Max에서 초당 228토큰, Ryzen AI Max+ 395에서 116토큰을 기록했고 갤럭시 S26 울트라에서도 초당 20토큰으로 완전 온디바이스 구동이 가능하며, 고동시성 환경에서는 초당 약 1만1천 토큰의 출력 처리량으로 4B급 모델의 약 2배 속도를 냈다.
- •SigLIP2 400M 비전 인코더+LFM2.5-2.6B 텍스트 백본, 약 34조 토큰 사전학습, 어휘 128K로 확장
- •화면/UI 이해·그라운딩·다중이미지·함수호출 4개 영역 강화, 동급 크기 모델 대비 벤치마크 우위
- •M5 Max 초당 228토큰, Galaxy S26 Ultra 초당 20토큰으로 완전 온디바이스 구동 가능
- •고동시성에서 초당 약 1.1만 토큰 처리, 4B급 모델 대비 약 2배 빠른 출력 속도
- •llama.cpp·MLX·vLLM·SGLang·ONNX 등 주요 추론 프레임워크를 출시 즉시 지원
0단 자동
AI가 규칙대로 쓰고 그대로 게시했습니다. 사람이 따로 보지 않았습니다.
- 규칙 판
- 규칙 판 도입 이전 기사입니다.
- 남기는 것
- 규칙 판 · 모델 · 시각
- 판 기록
- 아직 없습니다.
LFM2.5-VL-3B for Better and Faster Vision Capabilities for the Edge
전체 내용이 궁금하다면?
원문을 직접 읽어보세요
이 글이 만들어진 과정
- 10:21AI 초안

