Руководство по обработке
Подробное описание всех параметров и алгоритмов обработки аудио.
Адаптивное выравнивание
Адаптивное выравнивание автоматически корректирует перепады громкости внутри аудиофайла. Алгоритм анализирует и классифицирует сегменты на речь, музыку и фоновые звуки, после чего применяет индивидуальную обработку к каждому типу.
Что делает алгоритм:
- Усиливает тихих спикеров, выравнивая громкость диалогов
- Обрабатывает музыку так, чтобы она соответствовала громкости речи, сохраняя естественную динамику
- Исключает нежелательные сегменты (шум, ветер, дыхание) из усиления
- Применяет компрессоры и лимитеры для сбалансированного микса
Идеально подходит для: подкастов, радио, вещания, лекций, конференций, фильмов, видео и скринкастов.
Режимы работы
По умолчанию — единый набор параметров (сила выравнивания и компрессор) для всего аудио. Подходит для большинства случаев.
Раздельные параметры музыки/речи — независимая настройка силы выравнивания и компрессора отдельно для речи и музыки. Классификатор автоматически определяет тип контента. Параметр «Усиление музыки» позволяет сделать музыку громче или тише относительно речи.
Режим вещания — расширенный контроль для радио- и ТВ-вещания. Позволяет задать максимальный диапазон громкости (LU), максимальную кратковременную и моментную громкость относительно целевого уровня.
Параметры
- Сила выравнивания (0–120%) — чем выше значение, тем агрессивнее коррекция. 100% — значение по умолчанию. 0% — выравнивание отключено.
- Компрессор — «Авто» выбирает оптимальную настройку автоматически. Варианты: Мягкий, Средний, Сильный, Выкл.
Фильтрация
Адаптивная фильтрация улучшает качество звука за счёт удаления нежелательных частот и оптимизации частотного спектра голоса.
Адаптивный ВЧ-фильтр
Обрезает мешающие низкие частоты и помехи в зависимости от контекста. Алгоритм классифицирует самый низкий полезный сигнал (основные частоты голоса, диапазон музыки) и адаптивно удаляет лишние низкие частоты. Использует фильтрацию с нулевой фазой для сохранения формы сигнала.
Голосовой AutoEQ
Анализирует и оптимизирует частотный спектр голоса с помощью зависящих от времени профилей эквалайзера, применяемых отдельно для каждого спикера. Включает функцию De-Plosive — уменьшение резких взрывных звуков «п» и «т».
Голосовой AutoEQ + расширение полосы
В дополнение к AutoEQ включает расширение полосы частот (BWE) — алгоритм искусственно восстанавливает высокие частоты голоса, которые могли быть потеряны при записи, передаче или сжатии. Работает только с голосом, не затрагивая музыку, шум или ревербацию.
Нормализация громкости
Нормализация громкости приводит общий уровень громкости аудио к заданному целевому значению. Алгоритм рассчитывает текущую громкость и применяет постоянное усиление (или ослабление) для достижения целевого уровня в единицах LUFS или RMS.
Целевой уровень громкости
- -16 LUFS — подкасты, мобильные устройства, Apple Music, Spotify
- -23 LUFS (EBU R128) — стандарт для ТВ-вещания в Европе
- -24 LUFS (ATSC A/85) — стандарт для ТВ-вещания в США
- -27 LUFS — Netflix
- RMS — для платформ Audible и ACX (метод нормализации «Уровни RMS»)
True Peak Limiter
Система использует True Peak Limiter с 4-кратной передискретизацией для предотвращения межсэмпловых пиков (intersample peaks). Многопроходная нормализация обеспечивает точное соответствие целевому уровню.
Параметры
- Максимальный пиковый уровень — ограничивает пиковую громкость. «Авто» — оптимальное значение. EBU R128 рекомендует -1 dBTP, ATSC A/85 — -2 dBTP.
- Метод нормализации — «Громкость программы» для общей громкости, «Громкость диалога» для речевого контента, «Уровни RMS» для Audible/ACX.
- Двойное моно — включите для моно-контента в стерео-контейнере (прибавляет +3 LU).
Шумоподавление
Шумоподавление удаляет нежелательные звуки из аудиозаписи. Доступно четыре метода, каждый оптимизирован для определённых сценариев.
Динамический
Сохраняет речь и музыку, удаляя сложные, быстро меняющиеся шумы: шум толпы, ветер, трафик, звуки рта, ревербацию. Использует адаптивные AI-алгоритмы, которые непрерывно совершенствуются.
Лучший выбор для большинства случаев.
Изоляция речи
Выделяет исключительно речь, удаляя фоновую музыку и все шумы. Подходит для видео и записей с конкурирующими звуковыми элементами.
Статический
Удаляет ревербацию и медленно меняющийся широкополосный шум, сохраняя музыку и звуковые эффекты. Не справляется с нестатическими шумами и звуками дыхания. Использует AI-детекцию шума вместо шумовых профилей.
Классический (устаревший)
Удаляет широкополосный фоновый шум и гудение путём извлечения шумовых профилей из тихих участков записи. Включает подавление гудения (50/60 Гц и гармоники). Требует наличия тихих сегментов в записи.
Параметры
- Удаление шума — интенсивность шумоподавления (3–36 дБ, Авто ≈ 12 дБ). Чем выше значение, тем сильнее подавление, но возможны артефакты.
- Удаление реверберации — удаление эха и пространственного звучания (недоступно для классического метода).
- Удаление дыхания — подавление звуков дыхания (недоступно для статического и классического методов).
- Подавление гудения — удаление электрического гудения 50/60 Гц (только классический метод).
Автоматическое удаление
Алгоритмы автоматического удаления анализируют аудио и вырезают нежелательные фрагменты, сохраняя естественность звучания.
Типы удаления
Удаление тишины — вырезает паузы и тишину, при этом сохраняя намеренные речевые перерывы для естественного звучания.
Удаление слов-паразитов — распознаёт и удаляет слова-паразиты: «эм», «ах», «мм» и подобные. Поддерживает английский, немецкий и романские языки.
Удаление кашля — распознаёт и удаляет респираторные звуки: кашель, откашливание, чихание.
Удаление музыки — удаляет фрагменты фоновой музыки длительностью более ~20 секунд.
Режимы удаления
- Применить удаление — нежелательные фрагменты полностью вырезаются из аудио
- Заменить на тишину — фрагменты заглушаются (плавное затухание), длительность файла сохраняется
Выходной формат
Настройки формата определяют, в каком виде будет сохранён обработанный аудиофайл.
Форматы
- MP3 — универсальный формат с потерями. Поддерживается всеми устройствами и платформами.
- M4A/AAC — более эффективный формат с потерями. Лучшее качество при том же битрейте, чем MP3.
- Opus — современный формат с потерями. Отличное качество при низких битрейтах.
- FLAC — сжатие без потерь. Файлы в ~2 раза меньше WAV при идентичном качестве.
- ALAC — сжатие без потерь от Apple. Аналог FLAC для экосистемы Apple.
- Ogg Vorbis — открытый формат с потерями. Хорошее качество, ограниченная поддержка устройствами.
- WAV — несжатый формат. Максимальное качество, большой размер файла.
Битрейт
Битрейт доступен только для форматов с потерями (MP3, M4A, Opus, Ogg Vorbis). Чем выше битрейт, тем лучше качество и больше размер файла.
- 64–96 kbps — для речевого контента (подкасты, аудиокниги)
- 128–192 kbps — баланс качества и размера
- 256–320 kbps — высокое качество, близкое к оригиналу