LG유플러스가 AI 모델 최적화 스타트업 옵트에이아이와 손잡고 동일 GPU에서 처리 가능한 토큰량을 최대 4배로 늘리는 '토큰 최적화' 기술을 공동 연구한다. 기존 온디바이스 sLM 협력에서 거둔 전력 78%·크기 82% 감축 성과를 서버 GPU 클러스터로 확장한 것이다. LG유플러스는 상용 AI 서비스 파이프라인에서 기술을 실증하고, 옵트에이아이는 경량화 알고리즘 개발을 주도한다. 생성형 AI 인프라 운영비가 급증하는 상황에서 하드웨어 자원 효율을 높이는 실질적 대안이 될 전망이다.
- •동일 GPU에서 처리 가능한 토큰량을 기존 대비 최대 4배로 향상
- •기존 온디바이스 sLM 협력에서 전력 78%·모델 크기 82% 감축 성과 확보
- •퓨리오사AI, 베슬에이아이 등과 'Efficient AI 테크 세미나' 공동 개최
- •LG유플러스 2분기 영업이익 3,445억원으로 전년 대비 13.1% 증가
0단 자동
AI가 규칙대로 쓰고 그대로 게시했습니다. 사람이 따로 보지 않았습니다.
- 규칙 판
- 규칙 판 도입 이전 기사입니다.
- 남기는 것
- 규칙 판 · 모델 · 시각
- 판 기록
- 아직 없습니다.
LGU+, 옵트에이아이와 AI ‘토큰 최적화’ 맞손… 서버 GPU 처리량 최대 4배 확대

- 1.LG유플러스-옵트에이아이, 서버 GPU 토큰 처리량 최대 4배 늘리는 최적화 기술 공동연구
- 2.온디바이스 엑사원 sLM 적용 시 전력 78%·모델 크기 82% 절감 성과를 서버 인프라로 확대
- 3.퓨리오사AI·베슬에이아이·KETI·한양대와 '고효율 AI' 테크 세미나 개최
- 4.2분기 매출 3.69조원(-3.9%), 영업이익 3,445억원(+13.1%) 기록
왜 중요한가?
동일 GPU로 처리 가능한 토큰량을 4배 늘리는 기술은 생성형 AI 서비스 운영비의 핵심인 추론 비용을 직접 줄이는 접근으로, 통신사의 AI 인프라 비용 절감 경쟁에서 구체적 성과 지표를 제시한다.
본문 미리보기
연산 최적화로 동일 GPU서 토큰 처리량 4배… 인프라 비용 절감LG유플러스가 AI 모델 최적화 전문 스타트업 옵트에이아이와 손잡고 생성형 AI 서비스의 운영 비용을 획기적으로 낮추는 '토큰 최적화' 기술 고도화에 나선다.2일 LG유플러스는 옵트에이아이와 AI 모델 추론 연산 과정을 효율화해 동일한 GPU(그래픽처리장치) 자원에서 더 많은 사용자 요청을 처리하고 전력 소모를 줄이는 기술을 공동 연구한다고 밝혔다.토큰(Token)은 인공지능이 텍스트나 데이터를 이해하고 답변을 생성할 때 사용하는 최소 처리 단위다. 양사는 AI 모델이
전체 내용이 궁금하다면?
원문을 직접 읽어보세요
이 글이 만들어진 과정
- 10:46AI 초안