Startup cria chip para IA que será integrado aos servidores da Nvidia

d-Matrix usará tecnologia NVLink Fusion para conectar seus processadores de inferência aos sistemas de data center da Nvidia

A startup d-Matrix anunciou que seus chips especializados em inferência de inteligência artificial serão integrados aos sistemas de data center da Nvidia por meio da tecnologia NVLink Fusion.

A infraestrutura de inteligência artificial está entrando em uma nova fase, com empresas buscando chips especializados para executar modelos de IA com maior velocidade e eficiência. A startup d-Matrix anunciou que utilizará a tecnologia NVLink Fusion, da Nvidia, para integrar seus processadores de inferência aos sistemas de data center da companhia.

A parceria mira principalmente aplicações em que a resposta precisa ser gerada rapidamente, como chatbots, assistentes de programação e agentes de voz.

Treinamento e inferência são diferentes

Grande parte da atenção no mercado de inteligência artificial está concentrada no treinamento de modelos. Essa etapa exige enormes quantidades de processamento para ensinar sistemas de IA a reconhecer padrões e produzir respostas.

Depois do treinamento vem a inferência, quando o modelo já pronto é utilizado para responder a solicitações dos usuários.

Com a popularização dos agentes de IA, a quantidade de inferências realizadas diariamente tende a crescer significativamente.

Chip da d-Matrix será voltado para inferência

A d-Matrix desenvolveu uma arquitetura chamada Raptor, projetada especificamente para executar modelos de inteligência artificial.

A proposta é oferecer processamento com baixa latência para aplicações que precisam responder rapidamente aos usuários.

Em vez de substituir completamente as GPUs utilizadas nos servidores, os chips da empresa serão integrados aos sistemas da Nvidia.

NVLink Fusion conecta os componentes

A tecnologia NVLink Fusion permite que chips especializados de terceiros sejam conectados à infraestrutura de servidores da Nvidia.

Isso cria uma possibilidade interessante para empresas que desenvolvem aceleradores específicos sem precisar construir toda uma plataforma de data center do zero.

Na prática, a Nvidia pode continuar fornecendo a infraestrutura e a interconexão enquanto diferentes fabricantes desenvolvem processadores especializados para determinadas tarefas.

Foco está em respostas rápidas

Aplicações de inteligência artificial generativa precisam processar grandes quantidades de solicitações simultaneamente.

Em um chatbot, por exemplo, atrasos de apenas alguns segundos podem prejudicar significativamente a experiência do usuário.

Para agentes capazes de executar tarefas, sistemas de voz e assistentes de programação, a velocidade também é um fator importante.

Por isso, empresas estão desenvolvendo arquiteturas específicas para tornar a inferência mais rápida e eficiente.

Tecnologia deve chegar aos servidores em 2027

A integração dos processadores Raptor aos sistemas baseados na tecnologia da Nvidia está prevista para ocorrer comercialmente em 2027.

O projeto final dos chips da d-Matrix deve ser concluído até o final de 2026.

A empresa também trabalha com a Astera Labs no desenvolvimento de caminhos de dados de alta velocidade para seus sistemas.

Startup já recebeu investimentos importantes

A d-Matrix recebeu investimentos de grandes empresas de tecnologia. A Microsoft participou de uma rodada de financiamento de US$ 110 milhões realizada em 2023.

Em 2025, a startup levantou mais US$ 450 milhões, alcançando uma avaliação de aproximadamente US$ 2 bilhões.

A empresa enviou seu primeiro chip de inteligência artificial no final de 2024.

O mercado de chips de IA está se diversificando

A parceria mostra que o mercado de inteligência artificial está deixando de depender de uma única arquitetura de processamento.

Além das grandes GPUs, novas empresas estão desenvolvendo aceleradores específicos para diferentes etapas e aplicações de IA.

Essa diversificação pode aumentar a eficiência dos data centers e permitir que empresas escolham componentes diferentes de acordo com suas necessidades.

A próxima disputa pode ser pela inferência

À medida que mais pessoas e empresas utilizam inteligência artificial diariamente, o número de consultas processadas pelos modelos tende a crescer.

Isso pode transformar a inferência em um dos segmentos mais importantes da infraestrutura de IA.

A disputa pelo futuro da inteligência artificial não acontece apenas para criar modelos maiores. Ela também acontece nos chips, servidores e sistemas capazes de executar esses modelos rapidamente e em escala.

Fonte: Reuters
Compartilhe:
FORTIAXIS

Leia também