La startup audio islandaise Treble Technologies ehf a annoncé aujourd'hui avoir levé 18 millions de dollars de financement.
De nombreux robots industriels s’appuient sur des modèles d’intelligence artificielle embarqués pour effectuer leur travail. Ces modèles d’IA collectent souvent les données qu’ils utilisent pour prendre des décisions avec des microphones. Par exemple, un bras robotique pourrait traiter les instructions vocales du personnel humain de l’usine. Les véhicules autonomes écoutent les collisions lointaines et les bruits de construction.
Les ingénieurs apprennent aux robots à traiter l’audio en leur donnant des exemples des sons qu’ils devront analyser. Ces exemples de formation devaient historiquement être enregistrés manuellement, ce qui prend beaucoup de temps. Treble propose une plate-forme qui accélère le flux de travail.
Le logiciel de l'entreprise simule les environnements dans lesquels un robot est conçu pour fonctionner. À partir de là, il génère des sons synthétiques similaires à l’audio que le robot devra traiter. L'audio synthétique généré par Treble enseigne à l'IA embarquée de la machine comment interpréter les données acoustiques.
Les ingénieurs doivent prendre en compte de nombreux facteurs lors de la génération d’ensembles de données audio. La première est que la taille d’un espace intérieur influence la façon dont le son le traverse. Les matériaux à partir desquels l'installation est construite, son bruit de fond et la configuration des microphones d'un robot sont également pris en compte dans la qualité audio. De plus, les sons provenant d’objets en mouvement sont souvent plus difficiles à traiter qu’une source audio statique.
L'entreprise affirme que ses simulations peuvent tenir compte de tous ces facteurs. La plateforme de l'entreprise permet aux utilisateurs de mettre en place une simulation en téléchargeant un plan de l'espace intérieur qu'ils souhaitent reproduire. À partir de là, ils peuvent utiliser le code Python pour personnaliser l’environnement virtuel. C'est beaucoup plus rapide que de recréer physiquement chaque combinaison de conditions acoustiques dans lesquelles un robot est censé naviguer.
Treble produit l'audio qu'il génère sous la forme d'ensembles de données étiquetés. Cela signifie que les extraits sonores individuels sont associés à des métadonnées explicatives, ce qui facilite la formation de l'IA. De plus, le logiciel peut exécuter automatiquement des balayages de paramètres. Ce sont des flux de travail qui améliorent la précision d'un modèle d'IA en optimisant ses paramètres de configuration.
La startup propose sa plateforme ainsi que des ensembles de données audio préemballés qui évitent aux développeurs d'avoir à mettre en place des simulations. Selon l’entreprise, ses ensembles de données peuvent réduire de 38 % le taux d’erreur des modèles de reconnaissance vocale. Treble dit qu'ils se prêtent également à d'autres cas d'utilisation.
« Les modèles et appareils d'IA qui fonctionnent bien dans un laboratoire peuvent avoir des difficultés lorsqu'ils sont confrontés à une réverbération, à un bruit de fond ou à un environnement physique inconnu », a déclaré le co-fondateur et directeur général Finnur Pind. « Treble offre aux équipes de développement des principaux fabricants d'appareils mondiaux un moyen plus rapide et plus évolutif de modéliser ces conditions, de générer les données dont elles ont besoin et de tester les produits pour garantir leur fiabilité.
Treble utilisera le produit de son cycle de financement pour améliorer sa plateforme et accélérer les initiatives de mise sur le marché.