A startup d-Matrix anunciou nesta quinta-feira (10) que usará a tecnologia de interligação de chips da Nvidia para conectar seus processadores Raptor aos racks de servidores da gigante. O acordo, divulgado pela Reuters, visa serviços de IA de baixa latência: assistentes de programação, chatbots e agentes de voz.
Integração via NVLink Fusion
Os chips Raptor, especializados em inferência, serão conectados aos racks da Nvidia por meio do NVLink Fusion. Essa tecnologia combina conectores e memória especializada para integrar chips de IA personalizados a sistemas de data center da Nvidia de grande porte. Os racks compatíveis devem estar disponíveis em 2027; os Raptor devem concluir sua fase final de projeto até o fim deste ano.
A d-Matrix diz que os sistemas combinados vão para serviços de IA rápidos e de baixa latência, onde a velocidade é fundamental. Os termos financeiros da colaboração não foram divulgados. Além da Nvidia, a startup tem parceria com a Astera Labs para criar soluções personalizadas que garantam fluxo rápido de dados no sistema.
Mudança de mercado: do treinamento à inferência
As cargas de trabalho de IA estão mudando: do treinamento de modelos para a execução diária, um processo chamado inferência. Enquanto os processadores gráficos da Nvidia dominam o treinamento, a d-Matrix se especializa em inferência, um segmento que ganha importância com a adoção prática da IA.

A startup, sediada em Santa Clara, Califórnia, lançou seu primeiro chip de IA em novembro de 2024. Quando levtou US$ 450 milhões no ano passado, foi avaliada em US$ 2 bilhões. A Microsoft a apoia desde a rodada de US$ 110 milhões em 2023.
O que ainda não foi divulgado
Os termos financeiros da colaboração entre d-Matrix e Nvidia, assim como detalhes sobre clientes ou cronograma de adoção dos sistemas combinados, não foram revelados.


