Em 2 de outubro de 2026, a LG Uplus anunciou, segundo a Yonhap News, que firmou parceria com a empresa sul-coreana Opteye AI para desenvolver tecnologia de otimização de tokens de inteligência artificial, com o objetivo de reduzir o uso de GPU e de energia nos serviços de IA e aumentar a quantidade de tokens que podem ser processados por unidade de hardware.
Objetivo da parceria
Segundo a Yonhap News, a LG Uplus será responsável pela verificação técnica e pela aplicação prática das soluções, aproveitando sua experiência na operação de serviços de IA, enquanto a Opteye AI concentrará seus esforços na pesquisa e desenvolvimento de técnicas de leveza (lightweight) capazes de diminuir a quantidade de cálculo e o tamanho dos modelos de IA.
Resultados obtidos em smartphones
A Yonhap News relata que, em trabalhos anteriores, as duas empresas aplicaram a tecnologia de leveza a um modelo de linguagem pequeno baseado no EXAONE (sLM) para que ele rodasse no processador dedicado de IA (NPU) de smartphones. Nesse cenário, o desempenho foi mantido em nível semelhante ao obtido com CPU tradicional, mas o consumo de energia caiu 78 % e o tamanho do modelo foi reduzido em 82 %, segundo a mesma fonte.
Expansão para servidores GPU
A parceria agora amplia o escopo de pesquisa para ambientes de servidor equipados com GPU, conforme informado pela Yonhap News. As empresas afirmam ter assegurado um método que otimiza a forma de cálculo durante a geração de respostas pelos modelos de IA, permitindo que o mesmo processador de GPU lidar com até quatro vezes mais tokens do que antes, sem alterações no hardware.

Seminário de troca de conhecimentos
A Yonhap News também menciona que, em 1º de outubro de 2026, LG Uplus e Opteye AI realizaram um seminário conjunto para compartilhar tendências de pesquisa sobre eficiência na operação de IA e apresentar casos de aplicação industrial. Durante o encontro, as partes discutiram possíveis direções para a implantação da nova tecnologia de otimização de tokens em ambientes reais.
Próximos passos
A Yonhap News explica que o trabalho já realizado em smartphones serviu como prova de conceito para a técnica de leveza, mostrando que é possível reduzir o consumo de energia e o tamanho do modelo sem perder desempenho. Agora, as empresas pretendem aplicar o mesmo princípio em ambientes de servidor com GPU, onde o foco está em aumentar o número de tokens que cada unidade de processamento pode lidar durante a geração de respostas de IA.
Continuidade do trabalho
A Yonhap News ressalta que a nova fase da colaboração dá continuidade ao trabalho previamente realizado com o modelo EXAONE-based sLM, mas transferindo o foco de dispositivos móveis para servidores equipados com GPU, onde o objetivo é melhorar a eficiência do processamento de tokens.


