Русская версия The Next Web

Инвестиции Искусственный интеллект Стартапы и технологии

Treble привлекает $18 млн, чтобы научить физический ИИ слышать

Treble привлекает $18 млн, чтобы научить физический ИИ слышать

«Модели и устройства ИИ, которые отлично показывают себя в лаборатории, могут столкнуться с трудностями при наличии реверберации, фонового шума или незнакомой физической среды», — заявил Финнур Пинд (Finnur Pind), соучредитель и генеральный директор Treble Technologies.

Рейкьявикская компания привлекла $18 млн (около €15 млн) в рамках раунда финансирования Серии A-2, о чем она объявила 17 сентября. Лид-инвестором раунда выступил Paladin Capital Group. В нем также приняли участие существующие инвесторы KOMPAS VC, Frumtak Ventures и Фонд Европейского инновационного совета.

Таким образом, общий объем финансирования Treble достиг €36 млн. По заявлению компании, эти средства пойдут на поддержку ее роста на рынке США.

Моделирование помещений вместо их записи

Treble продает облачное программное обеспечение, которое моделирует распространение звука в пространстве. По словам представителей компании, ее платформа сочетает в себе акустическое моделирование, цифровые двойники и генерацию синтетических данных.

Создаваемые ею наборы данных охватывают различные помещения, материалы, транспортные средства, устройства, динамики и условия окружающего звука. Команды разработчиков могут генерировать размеченные наборы данных, тестировать краевые случаи, которые трудно воспроизвести, и сравнивать конфигурации продуктов в контролируемых условиях.

Это заменяет значительную часть работы по сбору записей в физических локациях, которую в Treble назвали медленной и дорогостоящей. По утверждению компании, такой подход позволяет сократить тестирование прототипов и сбор данных «с месяцев до дней».

Акустические инженеры Финнур Пинд и Йеспер Педерсен (Jesper Pedersen) основали Treble в Рейкьявике. Компания также продает свои решения архитекторам и инженерам, наряду с производителями оборудования и разработчиками ИИ.

Звук для физического ИИ

В Treble отметили, что разработка физического ИИ в основном была сосредоточена на зрении и осязании. Продукты также должны уметь слышать и интерпретировать звуки сквозь фоновый шум при различных планировках комнат и разном размещении микрофонов.

По словам представителей компании, движущееся устройство добавляет еще один уровень сложности. В качестве примеров они привели носимые устройства, гарнитуры, гуманоидные роботы и автономные транспортные средства. Meta готовит к выпуску умные очки без камеры, которые работают на базе голосового управления.

Другие стартапы также создают среды для обучения машин. NEURA Robotics строит спортзалы для сбора обучающих данных роботов. Компания Patronus AI привлекла $50 млн для стресс-тестирования агентов ИИ в условиях симуляции.

Amazon и Logitech

В Treble сообщили, что сотрудничали с Amazon и Logitech. Обе компании предоставили комментарии для этого объявления.

«На многих этапах разработки Alexa в качестве ИИ-ассистента мы полагаемся на виртуальные акустические среды для ускорения проектирования продуктов и разработки моделей», — рассказал Вонтак Ким (Wontak Kim), старший менеджер по исследованиям аудио в Amazon. Он отметил, что платформа позволяет Amazon виртуально оценивать качество звука и тестировать сценарии, которые невозможно воспроизвести с помощью одного лишь физического тестирования.

Энди Харпер (Andy Harper), руководитель отдела аудио-ИИ и обработки сигналов в Logitech, заявил, что симуляции охватывают акустические среды, которые трудно воспроизвести или протестировать в больших масштабах. «Достоверность лежащей в основе физики дает нам уверенность в этих симуляциях», — добавил он.

Комментарий инвестора

Франсуа Ройтеры (François Ruether), вице-президент Paladin Capital Group, отметил, что современные роботы в основном ограничены визуальным восприятием. Они могут обнаружить то, что находится перед ними, но не способны интерпретировать такие звуки, как «падение кого-то в другой комнате или авария за углом», пояснил он.

Платформа Treble призвана помочь роботам и моделям физического ИИ объединить визуальные и слуховые входные данные, считает Ройтеры. Он назвал эту мультимодальную способность важнейшим условием для того, чтобы роботы были полезными и безопасными для людей.

Инвестиции также активно направляются в голосовые модели и модели мира. В июле Fish Audio привлекла $52 млн на

открытые голосовые модели. Компания Emulate, основанная бывшими исследователями DeepMind, ведет переговоры о раунде на $700 млн.