AI 가볍고 빠르게 구동하는 기술 연구
기존보다 더 많은 이용자 요청 가능하도록 개선
기존보다 더 많은 이용자 요청 가능하도록 개선
이미지 확대보기토큰은 AI가 이용자의 질문을 이해하고 답변을 생성할 때 처리하는 데이터의 기본 단위다. 토큰 최적화는 AI 모델을 가볍게 만들거나 연산 과정을 효율화해 같은 자원으로 더 많은 요청을 처리할 수 있도록 하는 기술이다.
LG U+는 실제 AI 서비스 운영 경험을 바탕으로 기술 검증과 적용을 담당하고 옵트에이아이는 AI 모델을 더 가볍고 빠르게 구동하는 기술 연구와 개발을 맡는다. 양사가 보유한 역량을 결합해 AI 서비스 운영에 필요한 GPU와 전력 사용량을 줄이면서도 응답 속도와 서비스 품질을 높이는 것이 목표다.
양사는 이번 기술 교류를 계기로 서버 GPU 환경까지 공동 연구 범위를 확대한다. 대규모 AI 서비스를 운영할 때 같은 GPU 자원으로 더 많은 이용자의 요청을 처리할 수 있도록 AI 모델의 연산 과정을 효율화하는 기술을 중점적으로 연구할 계획이다.
LG U+는 향후 확보한 기술을 자사 AI 서비스와 대규모 AI 인프라 운영 환경에 단계적으로 적용하며 AI 운영 효율을 지속적으로 높여 나갈 계획이다.
이상엽 LG U+ 최고기술책임자(CTO)는 "AI 경쟁력은 단순히 성능을 높이는 것을 넘어 같은 자원으로 얼마나 많은 토큰을 효율적으로 처리할 수 있느냐에 달렸다"며 "옵트에이아이를 비롯한 다양한 파트너들과 협력해 토큰 최적화 기술 연구를 확대하고 실제 서비스에 적용할 수 있는 성과를 만들어 나가겠다"고 말했다.
이재호 옵트에이아이 대표는 "생성형 AI 시대에는 높은 성능만큼이나 운영 효율을 확보하는 것이 중요해지고 있다"며 "LG U+와 함께 실제 서비스 환경에서 검증 가능한 AI 최적화 기술을 고도화하고 AI 산업의 효율성 향상에 기여하겠다"고 말했다.
이재현 글로벌이코노믹 기자 kiscezyr@g-enews.com

































