인공지능(AI) 분야의 경쟁력을 더욱 강화하기 위해 LG유플러스는 인공지능 모델 최적화 전문 기업 옵트에이아이와 연합하여 AI 서비스 운영 효율성을 크게 높일 수 있는 ‘토큰 최적화’ 기술 개발에 나섰습니다. 이 협력은 LG유플러스의 CTO인 이상엽과 옵트에이아이 대표인 이재호가 주도하며, AI 서비스 운영 경험을 바탕으로 기술 검증 및 실제 적용 가능성을 갖추는 데 중점을 두고 있습니다.
이번 협력의 주요 목적은 AI 서비스에서 발생하는 인프라 비용 부담, 특히 GPU 연산량과 전력 소모 증가 문제를 해결하며 동일한 자원으로 더 많은 처리량을 실현하는 것입니다. 최근 급증하는 인프라 비용에 대응하기 위해 효율화 기술이 필수적인 요소로 부상하면서 LG유플러스와 옵트에이아이는 이를 해결할 수 있는 전략을 마련했습니다.
토큰 최적화의 핵심은 AI가 사용자의 질문을 이해하고 답변을 생성하는 데 필요한 데이터 처리 단위인 토큰을 최대한 효율적으로 관리하는 것입니다. LG유플러스는 ‘엑사원’ 기반 소형언어모델(sLM)을 경량화하여 온디바이스 NPU 환경에서 구동할 수 있도록 성공적으로 개선하였습니다. 이 과정에서 CPU 방식에 비해 전력 소비를 78% 줄이고 모델 크기를 82% 감소시켰습니다.
현재 진행 중인 서버 GPU 기반 최적화 연구에서도 LG유플러스와 옵트에이아이는 두각을 나타내고 있습니다. 연산 과정을 실제 서비스 환경에 맞춰 개선함으로써 동일한 GPU에서 처리 가능한 토큰량을 기존의 4배로 늘리는 성과를 거두었습니다. 이러한 발전은 AI 서비스 운영 비용을 크게 줄이면서도 성능을 유지하는 데 중요한 역할을 합니다.
LG유플러스 CTO 이상엽은 “AI의 경쟁력은 단순히 성능 향상에 그치지 않고, 동일 자원으로 처리 가능한 토큰 수를 최적화하는 데 있습니다”며 협력 파트너들과의 공동 노력을 통해 실제 서비스 환경에서도 적용할 수 있는 구체적인 성과를 만들어가겠다고 밝혔습니다. 이재호 옵트에이아이 대표 역시 “생성형 AI 시대에는 높은 성능만큼 운영 효율의 확보가 필수적”이라며 LG유플러스와 함께 검증 가능한 최적화 기술을 개발하여 산업 전체의 효율성을 높이겠다고 밝혔습니다.
이들의 협력은 AI 서비스가 직면하는 다양한 도전 과제를 해결하고자 하는 야심찬 시도로, 기술의 경량화와 효율적인 연산을 통해 미래의 AI 서비스 운영 방식에 새로운 지표를 제시할 것으로 기대됩니다. LG유플러스는 이러한 협력을 통해 더욱 진보된 AI 솔루션을 개발하고 시장에서의 경쟁력을 강화하는 계기로 삼아, 옵트에이아이와 함께 이 분야에서 리더십을 장악할 준비를 하고 있습니다.





