Voice AI is blijkbaar zo ontzettend hot dat investeerders met miljarden dollars smijten naar alles wat kan luisteren, terugpraten of vergadernotities kan maken. In deze goldrush stapt Treble, een in IJsland gevestigde startup opgericht in 2020 door akoestisch ingenieurs Finnur Pind en Jesper Pedersen, die net $18 miljoen heeft opgehaald in een uitbreiding van zijn Series A. De ronde werd geleid door Paladin Capital Group, met bestaande investeerders KOMPAS VC, Frumtak Ventures, EIC en Omega ehf. die ook bijdroegen. Dat volgt op een ophaling van $12 miljoen in 2024, waarmee het totaal van Treble op meer dan $40 miljoen komt. Het bedrijf rekent Amazon en Logitech tot zijn klanten, vermoedelijk omdat zelfs gigantische bedrijven iemand nodig hebben die hen vertelt hoe hun gadgets klinken.

De pitch van Treble is in essentie: al die nieuwe voice AI-modellen en -apparaten moeten getest worden, en testen vereist data. Heel veel data. In plaats van opnames van het internet te schrapen zoals iedereen, genereert Treble synthetische audiodata voor spraakverbetering, ruisonderdrukking en modeltraining. Het evalueert ook voice AI-modellen onder verschillende omstandigheden en geeft dat terug aan labs. Eerder dit jaar werkte het samen met Hugging Face om een benchmark te lanceren voor spraakherkenningsmodellen onder realistische omstandigheden - omdat iemand de machines moet beoordelen.

"Audio AI is echt een dataprobleem, en dit is waar de meeste kansen liggen om next-generation modellen en hardware mogelijk te maken," vertelde Pind aan TechCrunch. "Tot nu toe is vrijwel alle geluidsgerelateerde AI gemaakt van opnames en data die van het internet zijn geschraapt. Wij geloven dat nauwkeurige fysicasimulatie een alternatieve manier kan zijn om data voor geluid te creëren." Met andere woorden, waarom zou je vertrouwen op de rommelige echte wereld als je die kunt simuleren?

Naast software doet Treble hardwareontwerp en -testen vanuit een stemperpectief. Het helpt hoofdtelefoon- en luidsprekerfabrikanten om virtueel te prototypen hoe hun producten zouden kunnen klinken, test of een slimme luidspreker commando's kan begrijpen op basis van waar hij staat, en is onlangs begonnen met simulatietests voor slimme brillen en AI-apparaten. Pind is bijzonder enthousiast over wearables die gebruikers "superhuman hearing" kunnen geven. "Misschien ben je in een restaurant en wil je alleen mensen binnen een straal van twee meter horen, of je bent in een seminar en wilt de mensen om je heen dempen," zei hij. Want niets zegt vooruitgang als selectief de mensen om je heen negeren.

Het bedrijf richt zich ook op fysieke AI - robotica-, automotive- en dronebedrijven - om geluidsgebaseerde functies mogelijk te maken via testen en simulatie. Francois Ruether, VP van Paladin Capital Group, zei dat het platform van Treble opvalt omdat het verschillende modellen en apparaten simuleert, en dat het belang ervan alleen maar zal groeien. "Onze these is dat naarmate meer producten afhankelijk zijn van het begrijpen van geluid, deze infrastructuur steeds waardevoller wordt across voice AI, wearables, robotica en fysieke AI," zei Ruether. "Klanten behouden eigendom van hun modellen, producten en ontwikkelworkflows, terwijl ze profiteren van een gedeelde basis van een simulatie-native akoestische infrastructuurlaag." Wat een chique manier is om te zeggen: iedereen mag zijn spullen houden, maar ze hebben allemaal Treble's gesimuleerde geluid nodig om het te laten werken.