Как мы запустили серию аудиокниг, созданных нейросетями: полный кейс

Как мы запустили серию аудиокниг, созданных нейросетями: полный кейс, image #1

Представьте: аудиокниги, где от идеи до публикации почти всё делает искусственный интеллект. Звучит как фантастика? А вот и нет. Делимся реальным опытом создания серии, которая уже выходит на «Литрес» и регулярно пополняется новыми названиями.

Речь пойдет об аудиопроекте «Имена». В его рамках мы наладили выпуск качественного познавательного коммерческого аудиоконтента — быстро, доступно и без классических «человеческих» затрат.

Идея и задача

Мы хотели сделать серию аудиобиографий в удобном, «перевариваемом» формате. Требования заказчика звучали так:

  • Недорогое производство.
  • Достоверность материала и строгий фактчекинг.
  • Высокая производительность.
  • Отличное качество аудиотекста.
  • Единый, узнаваемый визуальный стиль.

Если ещё проще: нужно было быстро и в больших объемах генерировать достоверные биографии знаменитых людей, качественно их озвучивать и делать серийные обложки «с характером».

С такой задачей к нам пришел партнер — издательство «Директ-Медиа».

Как мы решали: 5 шагов

Шаг 1. Генерация контента

Сначала мы написали бота для OpenAI, который пишет тексты биографий. В его основе — заранее согласованная жесткая структура: систематизированное описание периодов жизни, творчества и профессионального пути. Получился своего рода чек-лист на пару сотен пунктов. Для каждого раздела заданы требования по объему и стилю.

На входе бот получает от одного до трех источников (электронные книги), которые редактор предварительно счел достоверными. Плюс — бот может добавлять информацию из проверенных интернет-источников. Дальше он поэтапно пишет главы будущей аудиобиографии. Аннотация прилагается.

Шаг 2. Фактчекинг

Как мы запустили серию аудиокниг, созданных нейросетями: полный кейс, image #2

Для проверки фактов используем дополнительный ИИ — Qwen или DeepSeek. Найденные расхождения бот прорабатывает отдельным запросом. Результат второго этапа — текст, в котором можно быть уверенным.

Шаг 3. Озвучивание

Тексты проходят ИИ-корректуру прямо в нашем конструкторе аудиокниг. Сложность текста невысокая, поэтому проблем с озвучкой нет. Отдельно расшифровываем числительные — в биографиях полно дат.

Как мы запустили серию аудиокниг, созданных нейросетями: полный кейс, image #3

Большинство книг проекта озвучены голосами от Google: они мало ошибаются, звучат естественно и стоят недорого.

Как мы запустили серию аудиокниг, созданных нейросетями: полный кейс, image #4

С помощью поисковых шаблонов редактор быстро проверяет строки с числительными, именами собственными и топонимами — то есть самые рискованные моменты. Ошибки исправляются массовыми операциями.

Как мы запустили серию аудиокниг, созданных нейросетями: полный кейс, image #5

Готовые аудиокниги экспортируются сразу в формате «Литрес» со всей метаинформацией и структурой.

Как мы запустили серию аудиокниг, созданных нейросетями: полный кейс, image #6

Шаг 4. Обложка

Вместе с дизайнером мы сделали прототип серийной обложки. Этот референс загружается во второго бота на OpenAI, куда также передаются название, автор, серия и прочие данные. Бот создает серийное изображение за 1–2 минуты.

Как мы запустили серию аудиокниг, созданных нейросетями: полный кейс, image #7
Как мы запустили серию аудиокниг, созданных нейросетями: полный кейс, image #8
Как мы запустили серию аудиокниг, созданных нейросетями: полный кейс, image #9
1 of 3

Шаг 5. Публикация

Честно говоря, это самый непростой этап. Для публикации на «Литрес» нужно подписать дополнительные соглашения на перечень книг и пройти всю необходимую бюрократию. После этого аудиокниги встают в очередь на выкладку — и через 2–4 недели появляются на витрине.

Посмотреть проект можно здесь
Даже без подписки на «Литрес» вы можете послушать ознакомительный фрагмент и оценить качество озвучки. Загляните на минутку 🙂

Отвечаем на популярные вопросы

— Как «Литрес» и другие площадки относятся к сгенерированному контенту?

— Нормально. Главное — честно указывать, что текст прочел ИИ, а в аннотации отмечать использование нейросетей. Слушатели тоже реагируют спокойно. Люди ценят, когда их не пытаются обмануть. А при высоком качестве контента любые опасения быстро проходят.

— Сколько человек работают над проектом и какова производительность?

— В производстве заняты двое. Первый занимается генерацией контента и оформлением, второй — озвучиванием и публикацией. Оба работают в режиме совмещения, это не основная занятость. В спокойном, комфортном темпе мы создаем 20 аудиобиографий в месяц.

— Сколько стоит производство одной такой аудиокниги?

— Коммерческая тайна 🙂 Но можем сказать так: это полностью цифровой продукт, который заметно дешевле классического книгоиздания. Что касается озвучки — она в 5 и более раз дешевле работы с живым диктором, арендой студии и мастерингом. И значительно быстрее.

Самое интересное напоследок

Реализовать подобный проект может практически любой, кто читает эту статью. Большинство задач решаются на нашем сайте — буквально в одном окне.

Ну, или вы всегда можете заказать проект у нашего партнера, издательства «Директ-Медиа»: одну книгу, целую серию или даже библиотеку 🙂

18 views·5 shares