
OpenAI представила новий інноваційний інструмент під назвою Voice Engine, який може відтворювати голос будь-якої людини з 15-секундного аудіосемпла.
що відомо
Мовний двигун аналізує короткі аудіосигнали і створює природні голоси з «емоційними і реалістичними голосами». Ця інноваційна технологія заснована на існуючому API перетворення тексту на мову OpenAI і може бути корисною для різних цілей, включаючи аудіокниги, мовний переклад і допомогу людям з порушеннями мови.
OpenAI усвідомлює значні ризики, пов'язані з використанням цієї технології, особливо можливість її неправильного використання зловмисниками. Тому компанія активно забезпечує конфіденційність та безпеку та ввела ряд заходів, таких як встановлення водяних знаків та попереджувальний моніторинг використання системи.
Як було оголошено, Voice Engine все ще перебуває у попередній версії, але компанія вже успішно провела пілотну програму, яка демонструє потенціал Voice Engine. Попередню версію було проведено в Університеті Брауна, де ця функція використовувалася для допомоги пацієнтам з мовними розладами.
OpenAI заявляє, що її голосовий двигун буде реалізований при збиранні відгуків від партнерів та дотриманні політики, що забороняє використання клонованих голосів без згоди людини. Крім того, для запобігання зловживанням буде створено «список заборонених голосувань.
Вартість питання
Орієнтовна вартість використання Voice Engine становить приблизно 15 доларів США за мільйон символів (приблизно 162 500 слів).
Джерело: Енгаджет