Нейросеть Neuro TTS стала доступна для бизнеса через API
Российская компания Neuro.net представила новое поколение технологии синтеза речи Neuro TTS. Эта разработка основана на использовании больших языковых и диффузионных моделей, которые создают голос, учитывая акустические особенности и контекст. Эту информацию сообщает издание Наша Газета Крым.
По информации пресс-службы компании, решение предназначено для интеграции в голосовые AI-сервисы. Бизнес может настраивать звучание AI-агентов и внедрять синтез в свои собственные сервисы через программный интерфейс. Платформа уже доступна для использования в рабочих продуктах.
Neuro TTS передает аудиоданные в потоковом режиме всего через 120 миллисекунд после получения запроса, что позволяет начинать воспроизведение до завершения генерации всей реплики.
При создании технологии был учтен опыт компании в автоматизации контакт-центров. В таких проектах синтез речи становится частью диалога: голосовой AI распознает речь клиента, определяет его намерения, формирует ответ и озвучивает его так, чтобы разговор оставался естественным и управляемым.
Александр Цепелев, глава группы компаний, в которую входит Neuro.net, отметил, что развитие искусственного интеллекта в России не должно ограничиваться несколькими корпорациями. Он подчеркнул, что независимые технологические компании должны иметь амбиции задавать темп рынку, и Neuro.net на протяжении многих лет развивает собственные технологии разговорного ИИ, стремясь к технологической независимости и конкурентоспособности своих продуктов.
Цепелев также добавил, что мировая конкуренция AI-компаний заставляет даже крупных игроков действовать быстрее и пересматривать свои стратегии. Он выразил надежду, что в России борьба за внимание бизнеса будет основываться на качестве технологий, скорости и результатах, и заявил о готовности компании создавать такую конкуренцию.


