Na IFA 2026, a NVIDIA (com a Microsoft como parceira) apresentou o RTX Spark, um desktop compacto para rodar IA localmente, e o NVIDIA PAIR, ferramenta de roteamento que distribui cargas de trabalho entre PCs da mesma rede; o hardware chega ao mercado em outubro de 2026, segundo o blog da NVIDIA (China) e o Everyeye Tech (Itália).
Modelos e otimizações de inferência
- Nemotron 3.5 Lightning, modelo de 30 bilhões de parâmetros, otimizado para RTX e DGX Spark – blog NVIDIA.
- GLM-5.3-Flash, modelo MoE multimodal da Zhipu AI – blog NVIDIA.
- Qwen3.8-Flash-Next, modelo MoE aberto da Alibaba – blog NVIDIA.
- Qwen3.8-27B, versão de 27 bilhões de parâmetros, também da Alibaba – blog NVIDIA.
- DeepSeek v4 Flash, com 284 bilhões de parâmetros (13 bilhões ativos), MoE que roda em cluster de duas unidades DGX Spark – blog NVIDIA.
- Muse Glimmer, modelo de 30 bilhões de parâmetros da Meta, focado em código e agentes – blog NVIDIA.
- LTX 2.5, modelo de geração de vídeo mundial otimizado para RTX e DGX Spark, com suporte a NVFP4 e FastVideo – blog NVIDIA.
- MiniMax‑H3, modelo de geração de vídeo com sincronia de áudio, cujo desempenho pode subir sete vezes via FastH3 – blog NVIDIA.
Ferramentas de implantação e roteamento
Segundo o blog da NVIDIA (China) e o Everyeye Tech (Itália), a NVIDIA lançou o PAIR (Personal AI Router), software open source gratuito que envia cada tarefa de IA para o PC da rede com a maior GPU livre no momento, funcionando com placas RTX Série 20 e chips Apple Silicon M4 ou superiores. Também foram citados o Hermes Agent, da Nous Research, e o OpenClaw, projeto que ultrapassa 380 mil estrelas no GitHub e agora tem integração simplificada para instalar modelos locais em Windows usando GPUs RTX com pelo menos 24 GB de VRAM.


