Руководство по обработке

Подробное описание всех параметров и алгоритмов обработки аудио.

Адаптивное выравнивание

Адаптивное выравнивание автоматически корректирует перепады громкости внутри аудиофайла. Алгоритм анализирует и классифицирует сегменты на речь, музыку и фоновые звуки, после чего применяет индивидуальную обработку к каждому типу.

Что делает алгоритм:

  • Усиливает тихих спикеров, выравнивая громкость диалогов
  • Обрабатывает музыку так, чтобы она соответствовала громкости речи, сохраняя естественную динамику
  • Исключает нежелательные сегменты (шум, ветер, дыхание) из усиления
  • Применяет компрессоры и лимитеры для сбалансированного микса

Идеально подходит для: подкастов, радио, вещания, лекций, конференций, фильмов, видео и скринкастов.

Режимы работы

По умолчанию — единый набор параметров (сила выравнивания и компрессор) для всего аудио. Подходит для большинства случаев.

Раздельные параметры музыки/речи — независимая настройка силы выравнивания и компрессора отдельно для речи и музыки. Классификатор автоматически определяет тип контента. Параметр «Усиление музыки» позволяет сделать музыку громче или тише относительно речи.

Режим вещания — расширенный контроль для радио- и ТВ-вещания. Позволяет задать максимальный диапазон громкости (LU), максимальную кратковременную и моментную громкость относительно целевого уровня.

Параметры

  • Сила выравнивания (0–120%) — чем выше значение, тем агрессивнее коррекция. 100% — значение по умолчанию. 0% — выравнивание отключено.
  • Компрессор — «Авто» выбирает оптимальную настройку автоматически. Варианты: Мягкий, Средний, Сильный, Выкл.

Фильтрация

Адаптивная фильтрация улучшает качество звука за счёт удаления нежелательных частот и оптимизации частотного спектра голоса.

Адаптивный ВЧ-фильтр

Обрезает мешающие низкие частоты и помехи в зависимости от контекста. Алгоритм классифицирует самый низкий полезный сигнал (основные частоты голоса, диапазон музыки) и адаптивно удаляет лишние низкие частоты. Использует фильтрацию с нулевой фазой для сохранения формы сигнала.

Голосовой AutoEQ

Анализирует и оптимизирует частотный спектр голоса с помощью зависящих от времени профилей эквалайзера, применяемых отдельно для каждого спикера. Включает функцию De-Plosive — уменьшение резких взрывных звуков «п» и «т».

Голосовой AutoEQ + расширение полосы

В дополнение к AutoEQ включает расширение полосы частот (BWE) — алгоритм искусственно восстанавливает высокие частоты голоса, которые могли быть потеряны при записи, передаче или сжатии. Работает только с голосом, не затрагивая музыку, шум или ревербацию.

Нормализация громкости

Нормализация громкости приводит общий уровень громкости аудио к заданному целевому значению. Алгоритм рассчитывает текущую громкость и применяет постоянное усиление (или ослабление) для достижения целевого уровня в единицах LUFS или RMS.

Целевой уровень громкости

  • -16 LUFS — подкасты, мобильные устройства, Apple Music, Spotify
  • -23 LUFS (EBU R128) — стандарт для ТВ-вещания в Европе
  • -24 LUFS (ATSC A/85) — стандарт для ТВ-вещания в США
  • -27 LUFS — Netflix
  • RMS — для платформ Audible и ACX (метод нормализации «Уровни RMS»)

True Peak Limiter

Система использует True Peak Limiter с 4-кратной передискретизацией для предотвращения межсэмпловых пиков (intersample peaks). Многопроходная нормализация обеспечивает точное соответствие целевому уровню.

Параметры

  • Максимальный пиковый уровень — ограничивает пиковую громкость. «Авто» — оптимальное значение. EBU R128 рекомендует -1 dBTP, ATSC A/85 — -2 dBTP.
  • Метод нормализации — «Громкость программы» для общей громкости, «Громкость диалога» для речевого контента, «Уровни RMS» для Audible/ACX.
  • Двойное моно — включите для моно-контента в стерео-контейнере (прибавляет +3 LU).

Шумоподавление

Шумоподавление удаляет нежелательные звуки из аудиозаписи. Доступно четыре метода, каждый оптимизирован для определённых сценариев.

Динамический

Сохраняет речь и музыку, удаляя сложные, быстро меняющиеся шумы: шум толпы, ветер, трафик, звуки рта, ревербацию. Использует адаптивные AI-алгоритмы, которые непрерывно совершенствуются.
Лучший выбор для большинства случаев.

Изоляция речи

Выделяет исключительно речь, удаляя фоновую музыку и все шумы. Подходит для видео и записей с конкурирующими звуковыми элементами.

Статический

Удаляет ревербацию и медленно меняющийся широкополосный шум, сохраняя музыку и звуковые эффекты. Не справляется с нестатическими шумами и звуками дыхания. Использует AI-детекцию шума вместо шумовых профилей.

Классический (устаревший)

Удаляет широкополосный фоновый шум и гудение путём извлечения шумовых профилей из тихих участков записи. Включает подавление гудения (50/60 Гц и гармоники). Требует наличия тихих сегментов в записи.

Параметры

  • Удаление шума — интенсивность шумоподавления (3–36 дБ, Авто ≈ 12 дБ). Чем выше значение, тем сильнее подавление, но возможны артефакты.
  • Удаление реверберации — удаление эха и пространственного звучания (недоступно для классического метода).
  • Удаление дыхания — подавление звуков дыхания (недоступно для статического и классического методов).
  • Подавление гудения — удаление электрического гудения 50/60 Гц (только классический метод).

Автоматическое удаление

Алгоритмы автоматического удаления анализируют аудио и вырезают нежелательные фрагменты, сохраняя естественность звучания.

Типы удаления

Удаление тишины — вырезает паузы и тишину, при этом сохраняя намеренные речевые перерывы для естественного звучания.

Удаление слов-паразитов — распознаёт и удаляет слова-паразиты: «эм», «ах», «мм» и подобные. Поддерживает английский, немецкий и романские языки.

Удаление кашля — распознаёт и удаляет респираторные звуки: кашель, откашливание, чихание.

Удаление музыки — удаляет фрагменты фоновой музыки длительностью более ~20 секунд.

Режимы удаления

  • Применить удаление — нежелательные фрагменты полностью вырезаются из аудио
  • Заменить на тишину — фрагменты заглушаются (плавное затухание), длительность файла сохраняется

Выходной формат

Настройки формата определяют, в каком виде будет сохранён обработанный аудиофайл.

Форматы

  • MP3 — универсальный формат с потерями. Поддерживается всеми устройствами и платформами.
  • M4A/AAC — более эффективный формат с потерями. Лучшее качество при том же битрейте, чем MP3.
  • Opus — современный формат с потерями. Отличное качество при низких битрейтах.
  • FLAC — сжатие без потерь. Файлы в ~2 раза меньше WAV при идентичном качестве.
  • ALAC — сжатие без потерь от Apple. Аналог FLAC для экосистемы Apple.
  • Ogg Vorbis — открытый формат с потерями. Хорошее качество, ограниченная поддержка устройствами.
  • WAV — несжатый формат. Максимальное качество, большой размер файла.

Битрейт

Битрейт доступен только для форматов с потерями (MP3, M4A, Opus, Ogg Vorbis). Чем выше битрейт, тем лучше качество и больше размер файла.

  • 64–96 kbps — для речевого контента (подкасты, аудиокниги)
  • 128–192 kbps — баланс качества и размера
  • 256–320 kbps — высокое качество, близкое к оригиналу