AI 분야의 급속한 발전과 함께, AI 모델의 성능 개선은 단순히 높은 계산력을 제공하는 것이 아니라, 적은 자원으로도 효율적인 서비스를 제공할 수 있는 방안을 찾는 것이 중요해지고 있다. 이러한 맥락에서 LG유플러스와 옵트에이아이가 함께 토큰 최적화 기술 연구를 진행하고 있는 것은 AI 서비스의 미래 방향을 결정짓는 중요한 움직임으로 평가된다.
LG유플러스 CTO 이상엽과 옵트에이아이 대표 이재호는 최근 기념촬영을 통해 AI 서비스의 운영 효율성을 높일 토큰 최적화 협력 프로젝트를 공식 발표하였다. 이번 연구는 특히 GPU와 전력 같은 리소스 사용량을 줄이면서도 AI 서비스의 응답 속도와 품질을 높일 수 있는 기술 개발에 초점을 맞추고 있다. 이를 통해 동일한 자원으로 처리할 수 있는 요청량을 최대 4배까지 증가시키는 것이 목표로 설정되었다.
AI 서비스의 확산에 따라 발생하는 운영 비용 증가 문제를 해결하기 위한 시도인 이 연구는 AI 모델을 가볍게 만들거나 연산 과정을 효율화하는 방법에 있어 LG유플러스의 실전 경험이 결합되며, 옵트에이아이의 기술적 노하우가 활용될 예정이다. 양사는 이를 통해 GPU 사용량을 줄일 수 있으면서도 서비스 성능을 극대화하는 방법을 모색하고자 한다.
LG유플러스와 옵트에이아이의 협력은 이미 이전부터 시작되어왔으며, 특히 지난해 9월 LG AI연구원과 함께 개발한 ‘엑사원 3.5’ 기반 소형언어모델(sLM)을 경량화하여 스마트폰의 NPU에서도 효율적으로 작동할 수 있도록 한 사례가 있다. 이와 같은 노력을 통해 CPU 방식과 비교할 때 전력 소모를 78%, 모델 크기를 82% 감소시키는 성공적인 결과를 거두었다.
이번 연구의 중요성은 단순한 기술 개발에 그치지 않고, AI 서비스가 어떻게 더욱 효과적으로 운영될 수 있을지에 대한 근본적인 방향성을 제시하고 있음을 의미한다. 이와 관련해 LG유플러스는 최근 ‘Efficient AI 테크 세미나’를 공동 주최, 다양한 분야의 전문가들과 AI 모델 최적화 기술에 대해 깊이 있는 논의를 진행하였다. 이러한 교류는 서버 GPU 환경까지 연구 범위를 넓혀, 대규모 AI 서비스 운영 시 효율성을 한층 더 높이기 위한 계획의 일환으로 이루어졌다.
LG유플러스는 이번 연구에서 얻은 기술적 성과를 자사 AI 서비스와 대규모 AI 인프라 운영 환경에 단계적으로 적용할 계획이다. CTO 이상엽은 “AI 경쟁력은 단순히 성능을 높이는 것을 넘어 같은 자원으로 얼마나 많은 토큰을 효율적으로 처리할 수 있느냐에 달려 있다”며 “옵트에이아이를 비롯한 다양한 파트너들과 협력하여 실제 서비스에 적용 가능한 토큰 최적화 기술을 확대할 것”이라고 밝혔다.
옵트에이아이는 2021년 11월 설립된 AI 모델 최적화 전문 스타트업으로, 리소스가 제한된 엣지 디바이스에서도 복잡한 AI 모델의 실시간 동작을 가능하게 하는 경량화 및 최적화 솔루션 개발에 주력하고 있다. 이러한 배경 덕분에 양사는 서로 보완할 수 있는 기술과 전문 지식을 공유함으로써 AI 분야에서의 혁신적인 발전을 추진할 계획이다.
현재 진행 중인 연구는 단순한 기술 개발에 그치지 않고, AI 서비스의 미래 방향성을 결정짓는 중요한 시도로 평가될 수 있다. 토큰 최적화를 통해 동일한 자원으로 처리할 수 있는 요청량을 증가시켜 AI 서비스의 운영 효율성을 극대화하는 것은 오늘날 점점 더 중요해지고 있는 문제인 리소스 사용 최적화를 해결하는 실질적인 방법이 될 수 있음을 보여준다. 이와 같은 연구는 AI 기술 발전의 새로운 길을 열어가며, 미래에 AI 서비스를 어떻게 구축할지에 대한 중요한 지침을 제공하고 있다.







