A NVIDIA anunciou a plataforma Vera Rubin, projetada para otimizar o custo-benefício de modelos de inteligência artificial na era dos agentes. O sistema foca em maximizar a inteligência por dólar ao lidar com cargas de trabalho de pós-treinamento, essenciais para modelos que precisam se adaptar continuamente a novos ambientes e ferramentas.
Foco no pós-treinamento contínuo
Diferente de modelos geradores de texto simples, os modelos agentes executam tarefas complexas, planejam ações e realizam correções autônomas. Esse comportamento exige um ciclo de aprendizado constante, ou pós-treinamento, que não se encerra após a fase inicial. Com o Vera Rubin, a NVIDIA busca sustentar esse fluxo de trabalho ininterrupto, permitindo que a atualização de pesos do modelo ocorra de forma eficiente em ambientes que mudam semanalmente.
Eficiência de hardware e escala
O hardware foi desenvolvido para lidar com o volume massivo de dados de reforço exigido pelo pós-treinamento. A plataforma permite reduzir a necessidade de recursos, utilizando apenas um quarto dos GPUs da geração Blackwell para treinar modelos de grande escala. Testes de processamento com o CPU Vera demonstraram um aumento de 30% na taxa de transferência em comparação com arquiteturas x86 alternativas. O sistema integra ferramentas como o NeMo RL e o NeMo Gym para automatizar a orquestração desses processos.
Adoção no mercado
Empresas e laboratórios já utilizam a infraestrutura NVIDIA para refinar seus modelos. Prime Intellect Lab, Perplexity e Together AI empregam tecnologias da marca para gerenciar o treinamento e a sincronização de modelos de larga escala. O modelo Nemotron 3 Ultra, com 550 bilhões de parâmetros, serve como referência de desempenho na plataforma, atingindo 71,7% de precisão no benchmark SWE-bench Verified.
O que ainda não foi divulgado
- Especificações técnicas completas e datas exatas de disponibilidade comercial da plataforma Vera Rubin.
- Detalhes sobre o cronograma de implementação para clientes de nuvem pública fora do ecossistema de parceiros atuais.
- Preço unitário ou custo de licenciamento específico por infraestrutura.
A notícia foi veiculada em 1 fonte, baseada em informações da NVIDIA Blog Korea, na Coreia do Sul.