Как создать аудиокнигу

РРедакция 18 июля 2026 г. 5 мин чтения
Содержание

Чтобы сделать аудиокнигу, решите формат озвучки (чтец или TTS), подготовьте финальный текст, запишите или синтезируйте аудио, отредактируйте и мастерите файлы по стандартам площадок, оформите метаданные и обложку, затем загрузите на дистрибьютора. Рассчитайте бюджет, права и модель роялти заранее — это сэкономит время и деньги.

Начитка или TTS: как выбрать формат озвучки

Аудиокнига из текста может быть создана двумя путями: человеческая начитка книги (приглашённый диктор/автор) или TTS озвучка (синтез речи). Выбор зависит от жанра, бюджета, сроков и требований площадок.

Сравнение подходов

КритерийЧеловеческая начиткаTTS озвучка
ВыразительностьВысокая, адаптация интонаций и темпаСредняя/высокая у премиум-голосов, но менее гибкая
СрокиДольше: запись, правки, сведениеБыстро: минутные/часовые партии за день
СтоимостьСредняя–высокаяНизкая–средняя
Допустимость платформамиПриемлемо вездеЗависит от правил магазина/агрегатора
Локализация имён/терминовГибкая, можно согласовать ударенияНужны словари, кастомные правила

Когда что выбирать

  • Художественная проза, мемуары, поэзия — чаще выигрывают от живой начитки.
  • Нон-фикшн, учебные тексты, корпоративные книги — допустима TTS при хорошем голосе и тщательной подготовке словаря ударений.
  • Пилот/MVP аудиокниги — TTS для теста спроса, затем возможна перезапись с диктором.

Запись и обработка: от студии до мастеринга

Технические стандарты (ориентиры)

  • Формат: WAV 24-bit/44.1–48 kHz для монтажа; итог — MP3 192–256 kbps или M4B/AAC согласно площадке.
  • Уровни: пиковый не выше −3 dBFS; средняя громкость около −18 LUFS (моно) / −16 LUFS (стерео), шум пола ниже −60 dBFS.
  • Структура: отдельный файл на главу; интро, аутро, технические 0.5–1.0 секунды тишины в начале/конце файла.

Запись живой начитки

  • Помещение: глушим отражения (занавеси, поролон, шкаф с одеждой), минимизируем шум (техника, улица).
  • Оборудование: конденсаторный микрофон на стойке, поп-фильтр, аудиоинтерфейс, закрытые наушники. Уровень гейна — без клиппинга на пиках.
  • Процесс: прогрев голоса, выдерживание расстояния 10–15 см, метки для оговорок, дыхательные паузы.

Монтаж и чистка

  • Удаление оговорок/шумов, выравнивание пауз, нормализация уровней, де-эссер (сибилянты), мягкая компрессия.
  • Шумоподавление — осторожно, чтобы не «искусственно» не окрасить голос; используйте спектральный ремонт точечно.
  • Сведение: единый тембр и громкость по всем главам; финальный контроль в наушниках и на мониторах.

Работа с TTS

  • Выбор голоса: тестовые прогоны фрагментов, проверка эмоциональности, чёткости, ударений.
  • Подготовка текста: сценарные разметки (паузы, ударения), словарь произношений (имена, аббревиатуры, заимствования).
  • Постобработка: удаление артефактов, выравнивание темпа, кроссфейды между блоками синтеза, единый мастеринговый профиль.

Метаданные и обложка: чтобы находили и слушали

  • Название и подзаголовок: чёткие, с ключевыми словами; автор(ы), чтец (если есть), серия, выпуск.
  • Аннотация: 600–1200 знаков, с фокусом на боль/ценность и целевую аудиторию; без спойлеров.
  • Ключевые слова и категории: соответствуют жанру и поисковым запросам слушателей.
  • Обложка: квадрат 2400×2400+ px, читабельный заголовок на мобильных, контраст, право на изображение подтверждено.

Площадки аудиокниг и дистрибуция

Публиковать можно напрямую там, где это разрешено для авторов, или через агрегаторов, которые развозят релиз в магазины и стриминги.

Маршруты выхода

  • Прямой контракт с локальными платформами (например, национальные книжные сервисы и крупные музыкальные экосистемы, поддерживающие аудиокниги).
  • Международные агрегаторы — распространение в магазины и приложения (например, крупные розничные каталоги и стриминговые сервисы, доступность зависит от региона и условий дистрибьютора).

Что учитывают площадки

  • Соответствие техническим требованиям (громкость, формат, структура файлов).
  • Права на текст и озвучку; согласие чтеца на коммерческое использование.
  • Политика в отношении TTS: часть магазинов принимает синтез при качественном результате и явном указании; другие требуют живой начитки — проверяйте правила перед загрузкой.

Стоимость и роялти: как посчитать экономику

Бюджет производства

СтатьяДиапазон (ориентиры)Комментарии
Диктор (за час готового аудио)4 000–20 000 ₽+Зависит от опыта, жанра, сложности, прав на коммерцию
Студия/звукорежиссёр1 500–5 000 ₽/часЗапись, монтаж, мастеринг
TTS озвучкаОплата по символам/минутамСтоимость варьируется по провайдерам и голосам
Обложка и верстка метаданных2 000–15 000 ₽Дизайн, проверка требований площадок

Оценка продолжительности: 9 300–10 000 слов ≈ 1 час готового аудио при среднем темпе. Рассчитайте объём, умножьте на ставку за «готовый час», добавьте 10–20% на правки.

Роялти и комиссии

  • Модель выплат обычно основана на «чистой выручке» после комиссий магазина и/или агрегатора.
  • Типовые диапазоны: 20–50% от чистой выручки для автора/правообладателя при неэксклюзивном распространении; эксклюзив может давать более высокие доли, но ограничивает каналы.
  • Стриминг/подписка: выплаты рассчитываются пропорционально прослушанным минутам/главам и зависят от пула подписки.
  • Минимальные пороги вывода и периодичность платежей различаются; планируйте денежный поток с учётом задержек.

Права и лицензии: не пропустите юридическую часть

  • Текст: убедитесь, что вы — правообладатель или имеете лицензию на создание аудиоверсии.
  • Голос: договор со чтецом/TTS-провайдером на коммерческое использование и территорию распространения.
  • Музыка/эффекты: либо полностью отказываемся, либо используем лицензии с правом коммерческого распространения и без конфликтов с площадками.
  • Указание типа озвучки: при TTS некоторые магазины требуют пометку в метаданных.

Маркетинг и отзывы: как обеспечить старт

  • Отрывок: бесплатная глава или 3–5 минут превью с сильным моментом.
  • Описание: первые 200 символов — крючок; добавьте 3–5 ключевых фраз, по которым вас ищут.
  • Промо: рассылка по читателям книги, короткие аудиорилсы/тизеры, кросс-постинг с бумажной/электронной версией.
  • Отзывы: оформив промокоды/ARCs, соберите ранние рецензии, оперативно отвечайте на вопросы.

Чек-лист запуска аудиокниги

  • Финальный текст вычитан и разбит на главы.
  • Выбран формат: начитка или TTS; протестированы голоса/дикторы.
  • Запись/синтез выполнены; файлы очищены и сведены до единого уровня.
  • Проверены техтребования площадки: формат, громкость, тишина в начале/конце.
  • Подготовлены метаданные, обложка, превью.
  • Права оформлены; договоры со чтецом/TTS подтверждены.
  • Выбран дистрибьютор, загружены файлы, назначены цены/территории.
  • Подготовлен план промо и отслеживания отзывов.
===TOC=== vybor-formata|Начитка или TTS: как выбрать формат озвучки zapis-i-obrabotka|Запись и обработка: от студии до мастеринга metadannye-i-oblozhka|Метаданные и обложка: чтобы находили и слушали distribuciya-ploshchadki|Площадки аудиокниг и дистрибуция stoimost-i-royalti|Стоимость и роялти: как посчитать экономику pravo-i-licenzii|Права и лицензии: не пропустите юридическую часть marketing-i-otzyvy|Маркетинг и отзывы: как обеспечить старт chek-list|Чек-лист запуска аудиокниги ===FAQ===

Частые вопросы

Можно ли выпускать аудиокнигу с TTS-озвучкой на всех платформах?

Нет. Политика по TTS различается: одни площадки принимают качественную синтетическую речь, другие требуют живой начитки. Проверьте правила выбранного магазина или агрегатора до производства.

Сколько часов аудио получится из моей книги?

Оценочно 9–10 тысяч слов соответствуют одному часу готового аудио при среднем темпе. Поделите объём рукописи на 9 500 — получите ориентировочное количество часов.

Что выгоднее: эксклюзив или неэксклюзив?

Эксклюзив часто даёт более высокую долю от чистой выручки, но ограничивает каналы и аудитории. Если для вас важнее охват и гибкость ценообразования, выбирайте неэксклюзив.

Нужна ли музыка и звуковые эффекты в аудиокниге?

Чаще нет. Площадки могут ограничивать музыку из‑за прав, а слушатели ожидают чистую начитку. Если добавляете, используйте лицензированный контент и держите уровень фона ниже голоса.

Можно ли озвучить книгу самому автору?

Да, если вы уверенно держите темп и дикцию, а звук соответствует стандартам. Рекомендуется пилотная запись 10–15 минут и тест на фокус-группе, затем — работа со звукорежиссёром.

Какие ошибки чаще всего срывают модерацию?

Пик клиппинга выше −3 dBFS, нестабильная громкость между главами, заметные шумы и дыхание, отсутствие технических пауз, неверные метаданные и обложка не по размеру.

Р
Редакция
Обновлено 18 июля 2026 г.