OpenAI клонирует ваш голос после 15 секунд разговора

OpenAI клонирует ваш голос после 15 секунд разговора

Voice Engine - синтетический голос, неотличимый от настоящего.

image

OpenAI представила первые результаты работы над уникальной разработкой – моделью Voice Engine. Технология способна генерировать естественно звучащую речь, идентичную оригинальному голосу диктора, используя всего лишь текст и 15-секундную аудиозапись. Небольшая модель способна создавать эмоциональные и реалистичные голоса.

Разработка Voice Engine началась в конце 2022 года. Модель уже находит применение в API преобразования текста в речь, а также в функциях ChatGPT Voice и Read Aloud. Вместе с тем, OpenAI осуществляет осторожный подход к более широкому распространению технологии, учитывая потенциал неправомерного использования синтетических голосов. Компания стремится инициировать диалог о безопасном внедрении синтетических голосов и адаптации общества к новым возможностям.

Среди ранних применений Voice Engine:

  • помощь в чтении для неграмотных и детей с использованием естественных и эмоциональных голосов;
  • перевод контента (видео и подкасты) для расширения глобальной аудитории;
  • улучшение предоставления основных услуг в отдаленных районах;
  • поддержка людей с заболеваниями, влияющими на речь, через терапевтические и образовательные приложения;
  • восстановление голоса у пациентов, страдающих от внезапных или дегенеративных состояний речи.

OpenAI подчеркивает серьезность рисков, связанных с генерацией речи, идеально имитирующей голоса людей, особенно в контексте выборов. В ответ на риски компания разработала меры безопасности, включая водяные знаки для отслеживания происхождения аудио, созданного Voice Engine, и активный мониторинг использования технологии. Партнеры, тестирующие Voice Engine, согласились с политикой использования, запрещающей имитацию другого лица или организации без согласия.

Компания предлагает шаги к повышению устойчивости общества к вызовам, представляемым убедительными генеративными моделями, включая пересмотр аутентификации на основе голоса как меры безопасности и разработку политик защиты использования чужих голосов в ИИ. OpenAI стремится к продолжению диалога о вызовах и возможностях синтетических голосов с политиками, исследователями, разработчиками и креативщиками, подчеркивая важность глобального понимания направления развития технологии.

Ваш мозг на 60% состоит из жира. Добавьте 40% науки!

Сбалансированная диета для серого вещества

Подпишитесь и станьте самым умным овощем