A startup d-Matrix anunciou nesta quinta-feira (10) que adotará a tecnologia de interligação de chips da Nvidia para utilizar seus processadores diretamente nos sistemas de data center da gigante de tecnologia, à medida que a demanda por IA se intensifica. As cargas de trabalho de inteligência artificial vêm mudando do treinamento de modelos de IA para a execução desses modelos no uso cotidiano, um processo conhecido como inferência. Enquanto os caros processadores gráficos da Nvidia dominam as cargas de trabalho de treinamento, a d-Matrix é especializada em inferência. Os novos chips da d-Matrix, chamados Raptor, serão conectados aos “racks” de servidores da Nvidia por meio do NVLink Fusion, uma tecnologia que possui conectores e memória especializada para que chips de IA personalizados possam ser integrados aos sistemas de data center de maior porte da Nvidia, informou a startup. Espera-se que os “racks” compatíveis com a Nvidia estejam disponíveis em 2027, com os chips Raptor programados para concluir sua fase final de projeto até o fim deste ano. A d-Matrix afirmou que os sistemas combinados têm como alvo serviços de IA rápidos e de baixa latência, como assistentes de programação, chatbots e agentes de voz, nos quais a velocidade é fundamental. A startup não divulgou os termos financeiros da colaboração. A startup sediada em Santa Clara, Califórnia, também tem parceria com a empresa de conectividade Astera Labs para desenvolver soluções personalizadas que garantam um fluxo rápido de dados em todo o sistema. A Microsoft apoia a d-Matrix desde sua rodada de financiamento de US$ 110 milhões em 2023. A startup, que lançou seu primeiro chip de IA em novembro de 2024, foi avaliada em US$ 2 bilhões quando levantou US$ 450 milhões no ano passado. Startup d-Matrix Reprodução/d-Matrix
Notícias
Startup apoiada pela Microsoft usará tecnologia de interligação de chips da Nvidia em servidores de IA
Fonte da notícia:
Valor
Valor
Deseja ler a íntegra original na fonte jornalística?
Acessar matéria no site Valor