Новости рынка голосовых моделей
Рынок голосовых моделей для искусственного интеллекта (ИИ) стремительно растет. Создатели и бизнес-компании ищут голосовые модели, которые могут быть более выраженными и реалистичными. Fish Audio, стартап из Пало-Альто, стремится удовлетворить эти потребности с помощью своей библиотеки более чем 15 000 натуральных языковых контролов.
За прошлый год стартап получил более 8 миллионов пользователей, которые используют открытую версию или платную версию его моделей. Annual recurring revenue (АРР) компании составляет $21 миллион.
Финансирование и планы развития
Чтобы продолжить свою работу, Fish Audio получила $52 миллиона в seed-раунде, который возглавил Coreline Ventures и Capital Today. В финансировании также участвовали 359 Capital, Parable, Play Time, Alphalist Partners, Bayhouse Ventures, Carya Venture Partners и HF0.
Генеральный директор Fish Audio Рисса Коу сказала, что компания планирует выпустить аудио-понимание модель в этом году и speech-to-speech модель. Это позволит компании расширить свою библиотеку голосовых моделей и улучшить их качество.
Конкуренты и планы Fish Audio
Рынок голосовых моделей для ИИ уже занят другими компаниями, такими как ElevenLabs, WellSaid, Cartesia, Speechify, Async и Krisp. Однако Рисса Коу сказала, что Fish Audio может конкурировать с этими компаниями за счет своих fine-grained контролов для разработчиков и эффективного обучения моделей.
Партнер 359 Capital Рико Маллоцци сказал, что Fish Audio может конкурировать с другими компаниями за счет своих технических навыков и умения создавать высококачественные голосовые модели.
Отзывы экспертов
Осукэ Хонда, партнер Coreline Ventures, сказал, что для того, чтобы модель голоса была успешной, необходимо обеспечить согласие создателей, прозрачность и атрибуцию. Он также отметил, что необходимо внедрить систему верификации владения голосом, четкие условия лицензирования, простую систему отчетности и удаления и систему совместного использования доходов.
