Isländska Treble tar in riskkapital för fysisk röstsimulering
Bygger plattform som skapar syntetisk akustik och stresstestar röstmodeller åt kunder som Amazon och Logitech, när fler prylar får mikrofoner visar sig dyraste jobbet vara att bevisa att de fungerar utanför demorummet
Bilder
Treble co-founder Finnur Pind Image Credits: Treble Image Credits:Treble
Image Credits:Treble
techcrunch.com
Det isländska uppstartsbolaget Treble, som bygger en plattform för fysikbaserad simulering av röster och ljudmiljöer, har tagit in 18 miljoner dollar i en förlängning av sin serie A-runda, rapporterar TechCrunch. Bolaget säljer verktyg som skapar syntetiska akustiska data och som kan pressa röstmodeller under olika verkliga förhållanden. Bland kunderna finns Amazon och Logitech.
Affärsidén är enkel: röstsystem fallerar oftare för att verkligheten är rörig än för att själva nätverksmodellen är ”dålig”. Mikrofoner överstyr, rum ger efterklang, vind och trafik dränker konsonanter, och var en enhet placeras påverkar allt från väckningsord till om en smart högtalare uppfattar rätt person. Treble tjänar pengar på att simulera sådana miljöer i stor skala, ta fram träningsdata för talförbättring och brusdämpning och köra utvärderingar som visar var prestandan rasar.
Detta är också ett sätt att runda det återkommande problemet med datainsamling för ljudbaserad artificiell intelligens. Inspelningar från nätet är billiga men juridiskt och etiskt snåriga, och de speglar ofta inte de miljöer som röstgränssnitt förväntas klara i bilar, lagerlokaler eller ute på gatan. Medgrundaren Finnur Pind säger till TechCrunch att fysikbaserad simulering i vissa fall kan ersätta insamlade inspelningar och låta utvecklingsteam skapa målinriktade data för precis den akustik de bryr sig om.
Bolaget säljer även tester av ”röstperspektiv” till hårdvarutillverkare: virtuell prototyputveckling för hörlurar och högtalare, samt försök som visar hur smarta högtalare tolkar kommandon beroende på var de står i ett rum. Enligt TechCrunch har Treble breddat sig till simulering för smarta glasögon och andra röststyrda enheter, i tron att bärbar teknik gör taligenkänning till ett ständigt påslaget gränssnitt snarare än en funktion i telefonen.
Investerarna finansierar därmed snarare infrastruktur än en enskild assistent eller tillämpning. Treble uppger att kunderna behåller ägandet över sina modeller och arbetssätt men använder ett gemensamt simuleringslager. Det passar en marknad där laboratorier snabbt lanserar nya röstmodeller men ändå behöver upprepbara sätt att mäta försämringar och svårfångade specialfall. Paladin Capital Groups Francois Ruether beskriver plattformen som infrastruktur byggd för simulering, som blir mer värdefull ju fler produkter som blir beroende av att förstå ljud.
Nästa satsning är ”fysisk” artificiell intelligens, som robotik, fordon och drönare, där ljud inte bara är ett användargränssnitt utan också en sensor. Kapitalrundan kommer samtidigt som konsumentelektronikbolag och laboratorier tävlar om att stoppa in mikrofoner i fler föremål – och sedan upptäcker att den dyra delen är att bevisa att mikrofonerna fungerar utanför demonstrationsrummet.