LG유플러스가 AI 최적화 기업 옵트에이아이와 토큰 처리량 최적화 기술 개발에 착수했다고 10월 2일 LG그룹 보도자료를 통해 밝혔습니다. 발표문에 따르면 같은 GPU에서 처리 가능한 토큰량이 최대 4배 늘어나는 초기 성과를 확인했다고 전했습니다.
발표문에 따르면 이번 성과는 GPU 하드웨어 성능 자체가 높아진 것이 아니라 소프트웨어 최적화로 같은 장비에서 소화하는 토큰량을 늘린 것입니다. '최대 4배'는 평균이 아니라 특정 조건에서 나타나는 조건부 수치로 소개됐습니다. 보도자료는 이를 초기 성과로 규정하며 측정 대상 모델·GPU 사양·워크로드·기존 대비 기준은 공개하지 않았습니다.
옵트에이아이 자사 뉴스룸에는 이번 발표가 아직 반영되지 않았고 최신 게시물은 2026년 8월 28일자입니다. 옵트에이아이 뉴스룸에 따르면 EMNLP 2026 2편과 EMNLP 2025·AAAI 2025 논문 채택, CES 2026 혁신상 이력을 소개하며 AI 모델 최적화 전문 기업임을 밝혔습니다. 발표 자체는 4개 독립 매체가 동시에 보도하면서 진위의 여지는 좁혀졌습니다.
헤드라인의 GPU 처리량 4배가 곧바로 검증된 실측값처럼 읽힐 수 있지만, 제3자 벤치마크나 학계 논문으로 뒷받침된 수치는 아직 확인되지 않았습니다. 발표문에 따르면 양사는 과거 온디바이스 협력에서 전력 78%·모델 크기 82% 감소를 자체 발표한 바 있으며 이 역시 당사자 수치로 별도의 외부 검증이 이뤄지지 않았습니다. 독립 벤치마크 공개 전까지 4배 수치는 조건 명시가 필요한 초기 성과로 읽는 편이 무난합니다.
보도자료에 따르면 양사는 AI 인프라 효율화를 목표로 협업을 이어가겠다고 강조했습니다. 이번 최적화 기술이 상용 인프라에 적용되는 시점과 실측 조건 공개 여부는 앞으로의 발표에서 확인할 지점이며, 수치의 기술적 타당성은 독립 검증 결과가 나와야 확립될 것으로 보입니다. 발표와 협업 착수는 공식 자료로 확립된 사실이고 4배 수치도 당사자 발표에 실재하지만 측정 조건 미공개 상태에서 그 자체를 확정 실측값으로 받아들이기는 어렵다,라는 점에서 대체로 사실로 정리됩니다.