Röst-AI är tydligen så hett just nu att investerare kastar miljarder dollar på vad som helst som kan lyssna, svara eller ta mötesanteckningar. In i detta guldrush kliver Treble, en isländsk startup grundad 2020 av akustikingenjörerna Finnur Pind och Jesper Pedersen, som just rest 18 miljoner dollar i en förlängning av sin Serie A. Rundan leddes av Paladin Capital Group, med befintliga investerare KOMPAS VC, Frumtak Ventures, EIC och Omega ehf. som också bidrog. Det följer på en resning på 12 miljoner dollar 2024, vilket bringar Trebles total till över 40 miljoner dollar. Företaget räknar Amazon och Logitech som kunder, förmodligen för att även jätteföretag behöver någon som berättar hur deras prylar låter.
Trebles pitch är i huvudsak: alla dessa nya röst-AI-modeller och enheter behöver testas, och testning kräver data. Massor av det. Istället för att skrapa inspelningar från internet som alla andra, genererar Treble syntetisk ljuddata för talförbättring, brusdämpning och modellträning. Det utvärderar också röst-AI-modeller under olika förhållanden och matar tillbaka det till labb. Tidigare i år partnerskapade det med Hugging Face för att lansera ett benchmark för taligenkänningsmodeller under realistiska förhållanden – för någon måste ju betygsätta maskinerna.
"Ljud-AI är verkligen en datautmaning, och det är här de flesta möjligheterna att möjliggöra nästa generations modeller och hårdvara ligger", sa Pind till TechCrunch. "Hittills har i stort sett all ljudrelaterad AI skapats från inspelningar och data som skrapats från internet. Vi tror att noggrann fysiksimulering kan vara ett alternativt sätt att skapa data för ljud." Med andra ord, varför förlita sig på den stökiga verkliga världen när man kan simulera den?
Utöver mjukvara gör Treble hårdvarudesign och testning ur ett röstperspektiv. Det hjälper hörlurs- och högtalarföretag att virtuellt prototypa hur deras produkter kan låta, testar om en smart högtalare kan förstå kommandon baserat på var den är placerad, och har på senare tid gått in i simuleringstestning för smarta glasögon och AI-enheter. Pind är särskilt entusiastisk över bärbara enheter som kan ge användare "superhörsel". "Kanske är du på en restaurang, och du vill bara höra människor inom två meters räckvidd, eller du är på ett seminarium och vill tysta människor runt omkring dig", sa han. För inget säger framsteg som att selektivt ignorera människorna omkring sig.
Företaget siktar också på fysisk AI – robotik-, fordons- och drönarföretag – för att möjliggöra ljudbaserade funktioner genom testning och simulering. Francois Ruether, VP på Paladin Capital Group, sa att Trebles plattform sticker ut eftersom den simulerar olika modeller och enheter, och dess betydelse kommer bara att växa. "Vår tes är att i takt med att fler produkter är beroende av att förstå ljud, blir denna infrastruktur allt mer värdefull inom röst-AI, bärbara enheter, robotik och fysisk AI", sa Ruether. "Kunder behåller ägandet av sina modeller, produkter och utvecklingsarbetsflöden, samtidigt som de drar nytta av en delad grund av ett simuleringsnativt akustiskt infrastrukturlager." Vilket är ett fint sätt att säga: alla får behålla sina saker, men de behöver alla Trebles simulerade ljud för att få det att fungera.
The Good Times
Nyheter i din inkorg.
En sardonisk sammanfattning, levererad enligt ditt schema. Gratis. Avsluta prenumerationen när du vill.
Redan prenumerant men vi dyker aldrig upp? Kolla skräppostmappen och klicka på 'Inte skräppost' (eller 'Ta bort från skräppost') för att rädda oss ur skräppostens skärseld. På köpet hjälper du alla andra.
Om du inte öppnar något av våra mejl på en månad tas du automatiskt bort från listan.
Rewrite Article
Select parts to regenerate with a fresh AI pass. Translations will be updated automatically.
Generate AI Image
Creates a sardonic version of the article image using OpenAI.