Энтузиаст под ником WhiskeyCoder опубликовал на платформе GitHub открытый инструмент Qwen3 Audiobook Converter для быстрого создания аудиокниг из обычного текста. Сервис умеет работать с множеством популярных цифровых форматов, включая PDF, EPUB, DOCX, DOC и классический TXT. Главной особенностью проекта стала встроенная функция клонирования голоса и наличие режима с несколькими дикторами, который отлично подойдет для глубокого многоголосого озвучивания художественной литературы.

Для корректного запуска генератора потребуется локально развернутая Qwen Voice Model с интерфейсом Gradio, а на самом компьютере должны быть предварительно установлены Python версии 3.8 или выше и набор библиотек FFmpeg. В основе всей системы лежит продвинутая модель Qwen3 TTS объемом 1,7 миллиарда параметров, которую авторы называют решением с самым высоким качеством. В базовых настройках программы по умолчанию прописан англоязычный голос профессионального мужского диктора по имени Ryan.
Все новости игровой индустрии в Telegram: https://t.me/nxpgames Помогаю купить в Европе консоли, кастомные геймпады, лимитки, коллекционки, стандартные издания игр, мерч и фигурки пиши в личку: https://t.me/nxpgamesru
Скорость генерации звука пока требует определенных временных затрат, так как на обработку одного фрагмента текста алгоритм тратит примерно 4-5 минут. Готовые аудиокниги утилита автоматически сохраняет в привычном и удобном формате MP3. На странице репозитория пользователи могут найти пример сгенерированного аудио и прямую ссылку на саму модель Qwen3 TTS для самостоятельных тестов. Дополнительную свободу энтузиастам дает вышедшая этой весной версия Qwen 3.6 без цензуры, которая готова озвучивать абсолютно любые тексты без отказов из-за нарушения внутренних принципов нейросети.
Появление подобных открытых инструментов кардинально меняет подход к созданию любительских аудиокниг. Такие технологии открывают огромный потенциал для нишевой литературы — например, для создания атмосферных проектов в жанре темного фэнтези, где история о трудном пути одиночки будет звучать максимально убедительно благодаря тонким настройкам интонаций и клонированию подходящего тембра. Повсеместное внедрение нейросетей неизбежно демократизирует рынок, позволяя независимым авторам и фанатам самостоятельно переводить свои текстовые произведения в качественный аудиоформат без студийных затрат.
Чтобы точно ничего не пропустить, подписывайся на соцсети:




