Startup apoiada pela Microsoft usará tecnologia de interligação de chips da Nvidia em servidores de IA | Empresas
A startup d-Matrix anunciou nesta quinta-feira (10) que adotará a tecnologia de interligação de chips da Nvidia para utilizar seus processadores diretamente nos sistemas de data center da gigante de tecnologia, à medida que a demanda por IA se intensifica.
As cargas de trabalho de inteligência artificial vêm mudando do treinamento de modelos de IA para a execução desses modelos no uso cotidiano, um processo conhecido como inferência. Enquanto os caros processadores gráficos da Nvidia dominam as cargas de trabalho de treinamento, a d-Matrix é especializada em inferência.
Os novos chips da d-Matrix, chamados Raptor, serão conectados aos “racks” de servidores da Nvidia por meio do NVLink Fusion, uma tecnologia que possui conectores e memória especializada para que chips de IA personalizados possam ser integrados aos sistemas de data center de maior porte da Nvidia, informou a startup.
Espera-se que os “racks” compatíveis com a Nvidia estejam disponíveis em 2027, com os chips Raptor programados para concluir sua fase final de projeto até o fim deste ano.
A d-Matrix afirmou que os sistemas combinados têm como alvo serviços de IA rápidos e de baixa latência, como assistentes de programação, chatbots e agentes de voz, nos quais a velocidade é fundamental.
A startup não divulgou os termos financeiros da colaboração.
A startup sediada em Santa Clara, Califórnia, também tem parceria com a empresa de conectividade Astera Labs para desenvolver soluções personalizadas que garantam um fluxo rápido de dados em todo o sistema.
A Microsoft apoia a d-Matrix desde sua rodada de financiamento de US$ 110 milhões em 2023. A startup, que lançou seu primeiro chip de IA em novembro de 2024, foi avaliada em US$ 2 bilhões quando levantou US$ 450 milhões no ano passado.
Crédito: Link de origem