10 Set (Reuters) - A startup d-Matrix anunciou nesta quinta-feira que adotará a tecnologia de interligação de chips da Nvidia para utilizar seus processadores diretamente nos sistemas de data center da gigante de tecnologia, à medida que a demanda por IA se intensifica.
As cargas de trabalho de inteligência artificial vêm mudando do treinamento de modelos de IA para a execução desses modelos no uso cotidiano, um processo conhecido como inferência. Enquanto os caros processadores gráficos da Nvidia dominam as cargas de trabalho de treinamento, a d-Matrix é especializada em inferência.
Os novos chips da d-Matrix, chamados Raptor, serão conectados aos racks de servidores da Nvidia por meio do NVLink Fusion, uma tecnologia que possui conectores e memória especializada para que chips de IA personalizados possam ser integrados aos sistemas de data center de maior porte da Nvidia, informou a startup.
Espera-se que os racks compatíveis com a Nvidia estejam disponíveis em 2027, com os chips Raptor programados para concluir sua fase final de projeto até o fim deste ano.
A d-Matrix afirmou que os sistemas combinados têm como alvo serviços de IA rápidos e de baixa latência, como assistentes de programação, chatbots e agentes de voz, nos quais a velocidade é fundamental.
A startup não divulgou os termos financeiros da colaboração.
A startup sediada em Santa Clara, Califórnia, também está em parceria com a empresa de conectividade Astera Labs para desenvolver soluções personalizadas que garantam um fluxo rápido de dados em todo o sistema.
A Microsoft apoia a d-Matrix desde sua rodada de financiamento de US$110 milhões em 2023. A startup, que lançou seu primeiro chip de IA em novembro de 2024, foi avaliada em US$2 bilhões quando levantou US$450 milhões no ano passado.
(Reportagem de Anhata Rooprai, em Bengaluru, e Stephen Nellis, em San Francisco)



Aviso