Infinity Levanta $15M para Construir um Rival à Altura do CUDA da Nvidia, um Kernel de Cada Vez
Infinity levanta $15M para construir uma alternativa ao CUDA que permite que modelos de IA rodem em qualquer chip, porque o monopólio da Nvidia poderia usar um pouco de concorrência.
A startup de infraestrutura de IA Infinity levantou $15 milhões em uma avaliação de $100 milhões, com apoio da Touring Capital, Principal VC e pesquisadores da OpenAI e Anthropic. A empresa está em uma missão para tornar o domínio da Nvidia no mercado de chips de IA um pouco menos dominante, construindo software que permite que modelos de IA rodem em qualquer chip, não apenas nos da Nvidia.
O domínio da Nvidia não é apenas sobre suas GPUs poderosas; é também sobre o CUDA, a camada de software que transforma processadores gráficos em cavalos de batalha de computação de uso geral. Grandes frameworks de IA como PyTorch e TensorFlow são construídos sobre o CUDA, o que significa que aplicativos escritos em Python usam automaticamente chips Nvidia. A maioria das startups não tem recursos para escrever seu próprio software de kernel de baixo nível para portar aplicativos para chips alternativos. A Infinity pretende ser a alternativa ao CUDA, criando uma biblioteca de inferência universal que funciona em SRAM, GPUs, chips de telefone e Matrizes Systolic. Faz parte de uma onda de startups que estão corroendo a participação de mercado da Nvidia, um produto de cada vez.
Fundada no ano passado por Jeremy Nixon, ex-pesquisador do Google Brain e criador da rede de hackers AGI House, a Infinity nasceu da obsessão de Nixon com "invenção automatizada". Ele inventou anteriormente um algoritmo de aprendizado de máquina chamado Omega, que gerava e avaliava automaticamente novos algoritmos em um ciclo de feedback. Esse sucesso o levou ao hardware, onde ele acreditava que sistemas automatizados poderiam gerar o código de baixo nível necessário para rodar chips de forma mais eficaz.
O agente de pesquisa de IA da Infinity, Ignition, escreve código de baixo nível para inferência de IA em chips que não são da Nvidia. Ele testa, depura, mede desempenho e reescreve código conforme necessário, aprendendo e se adaptando continuamente a diferentes arquiteturas de chip. O resultado, afirma Nixon, é uma pilha de software no nível do CUDA. Os clientes incluem a D-Matrix, uma fabricante de chips de IA e desafiante da Nvidia, e a Infinity está em negociações com outras grandes empresas de chips e nuvem.
Humanos ainda fornecem direção de alto nível, mas o Ignition cuida do trabalho pesado. Em um estudo de caso, o agente reduziu o que poderia ser um processo de anos para horas ou dias. A Infinity não cobra taxa de licença antecipada; em vez disso, fica com uma parte dos ganhos de desempenho e economia de custos, medidos em tokens por segundo. A empresa atualmente tem 26 funcionários abrangendo design, operações e engenharia.
The Good Times
Notícias na sua caixa.
Um resumo sardônico, entregue conforme sua agenda. Grátis. Cancele quando quiser.
Já está inscrito mas nunca chegamos à sua caixa de entrada? Veja a pasta de spam e clique em 'Não é spam' (ou 'Remover do spam') para nos tirar do purgatório do lixo eletrônico. De quebra, ajuda todo mundo.
Se você não abrir nenhum dos nossos e-mails por um mês, será removido automaticamente da lista.
Rewrite Article
Select parts to regenerate with a fresh AI pass. Translations will be updated automatically.
Generate AI Image
Creates a sardonic version of the article image using OpenAI.