Infinity haalt $15 miljoen op om Nvidia's CUDA een waardige rivaal te bouwen, één kernel tegelijk
Infinity haalt $15 miljoen op om een CUDA-alternatief te bouwen waarmee AI-modellen op elke chip kunnen draaien, want Nvidia's monopolie kan wel wat concurrentie gebruiken.
AI-infrastructuurstarter Infinity heeft $15 miljoen opgehaald bij een waardering van $100 miljoen, met steun van Touring Capital, Principal VC en onderzoekers van OpenAI en Anthropic. Het bedrijf is op een missie om Nvidia's wurggreep op de AI-chipmarkt iets minder wurgend te maken door software te bouwen waarmee AI-modellen op elke chip kunnen draaien, niet alleen die van Nvidia.
Nvidia's dominantie draait niet alleen om zijn krachtige GPU's; het gaat ook om CUDA, de softwarelaag die grafische processors omtovert tot werkpaarden voor algemene computertaken. Grote AI-frameworks zoals PyTorch en TensorFlow zijn gebouwd op CUDA, waardoor apps die in Python zijn geschreven automatisch standaard naar Nvidia-chips gaan. De meeste startups missen de middelen om hun eigen low-level kernelsoftware te schrijven om apps naar alternatieve chips te porteren. Infinity wil het CUDA-alternatief zijn en een universele inferentiebibliotheek creëren die werkt op SRAM, GPU's, telefoonchips en Systolic Arrays. Het maakt deel uit van een golf van startups die stukje bij beetje aan Nvidia's marktaandeel knagen.
Opgericht vorig jaar door Jeremy Nixon, een voormalig Google Brain-onderzoeker en bedenker van het hackernetwerk AGI House, is Infinity ontstaan uit Nixon's obsessie met 'geautomatiseerde uitvinding'. Hij vond eerder een machine learning-algoritme uit genaamd Omega, dat automatisch nieuwe algoritmen genereerde en evalueerde in een feedbackloop. Dat succes leidde hem naar hardware, waar hij geloofde dat geautomatiseerde systemen de low-level code konden genereren die nodig is om chips effectiever te laten draaien.
Infinity's AI-onderzoeksagent, Ignition, schrijft low-level code voor AI-inferentie op niet-Nvidia-chips. Het test, debugt, meet prestaties en herschrijft code indien nodig, terwijl het continu leert en zich aanpast aan verschillende chiparchitecturen. Het resultaat, beweert Nixon, is een softwarestack op CUDA-niveau. Klanten zijn onder andere D-Matrix, een AI-chipmaker en Nvidia-concurrent, en Infinity is in gesprek met andere grote chip- en cloudbedrijven.
Mensen geven nog steeds richting op hoog niveau, maar Ignition doet het vuile werk. In een casestudy verkortte de agent wat een jarenlang proces had kunnen zijn tot uren of dagen. Infinity rekent geen upfront licentiekosten; in plaats daarvan krijgt het een deel van de prestatieverbeteringen en kostenbesparingen, gemeten in tokens per seconde. Het bedrijf heeft momenteel 26 medewerkers, verdeeld over ontwerp, operaties en engineering.
The Good Times
Nieuws in je inbox.
Een sardonische samenvatting, bezorgd op jouw schema. Gratis. Meld je af wanneer je wilt.
Al geabonneerd maar zie je ons nooit? Kijk in je spammap en klik op 'Geen spam' (of 'Verwijderen uit spam') om ons uit het ongewenste-mailvagevuur te bevrijden. Je helpt er iedereen mee.
Open je een maand lang geen van onze e-mails, dan word je automatisch van de lijst verwijderd.
Rewrite Article
Select parts to regenerate with a fresh AI pass. Translations will be updated automatically.
Generate AI Image
Creates a sardonic version of the article image using OpenAI.