Статия
Почистване и подготовка на аудио за подкаст
Суров гласов запис обикновено се нуждае от три неща, преди да е готов за публикуване: последователно ниво на силата на звука, формат и скорост на битовете, очаквани от платформите за стрийминг, и честна оценка на това, което отстраняването на шум действително може да постигне. Тази статия обхваща тези стъпки с помощта на audio-volume, vocal-remover и audio-converter, всички работещи локално в браузъра.
Сила на звука срещу пик: защо LUFS е по-важен от пиковото ниво
Пиковото ниво измерва единичния най-силен семпъл в аудио файл. Силата на звука, изразена в LUFS (единици на силата на звука спрямо пълна скала), измерва възприеманата енергия с течение на времето. Подкаст, записан при -3 dBFS пик, все още може да звучи тихо, ако по-голямата част от сигнала седи много по-ниско. Платформите за стрийминг и директориите за подкасти нормализират аудиото до целева сила на звука при възпроизвеждане, обикновено -14 LUFS за музикални услуги и -16 LUFS за произносен текст, така че изпращането при много различно ниво означава, че платформата ще увеличи или намали аудиото ви независимо. Насочването към интегрирана сила на звука от -16 LUFS ви дава завършен файл, съответстващ на стандарта на платформата, последователен с другите предавания и оставящ малко резерв преди цифровия таван от 0 dBFS. Истинският пик, отчитащ превишавания между семплите, обикновено се поддържа под -1 dBTP. Насочването и към двете числа заедно дава по-чист резултат от преследването само на целева за пик стойност.

Усиление и нормализиране с audio-volume
audio-volume ви позволява да настройвате усилването на файл в децибели или да прилагате нормализиране на силата на звука. Ако записът е последователно тих, добавянето на усиление в dB повишава целия сигнал с фиксирана стойност. Рискът е изрязване: ако някой пик вече седи близо до 0 dBFS, положително усилване ще го избута извън, въвеждайки цифрово изкривяване. Проверете формата на вълната преди прилагане на усилване и поддържайте истинския пик под -1 dBFS след корекцията. Нормализирането на силата на звука приема различен подход. Инструментът изпълнява филтъра loudnorm на FFmpeg с целта му по подразбиране от -24 LUFS интегрирана сила на звука, вместо по-високите цели, препоръчвани от някои платформи за подкасти. Едноходовият loudnorm е динамичен процес, а не плоско изместване на усилването: той следи силата на звука във времето и коригира сигнала, за да се доближи до целта, което може да прилича донякъде на лека компресия на динамичния диапазон при непоследователен запис. За гласов запис с големи колебания на нивото между изреченията, специализиран компресор или ограничител, приложен преди нормализирането, все още дава по-контролиран резултат, но тези стъпки са извън обхвата на audio-volume.
Какво може и какво не може да прави отменянето на централния канал
vocal-remover прилага техника за отменяне на централния канал. В стерео файл, сигнал, появяващ се еднакво в левия и десния канал при едно и също ниво и фаза, се казва, че е централно панориран. Изваждането на десния канал от левия премахва всичко в тази централна позиция, оставяйки главно съдържанието, панорирано към страните. Това е, което създава ефекта на karaoke в търговски мастериран музикален запис, при който основните вокали обикновено са централно панорирани. Той не открива или разделя гласове с помощта на модел на речта. Той не премахва фонов шум, стайна реверберация, жужене от климатик или трафик. Той не изолира гласа ви за подкаст от атмосферен звук в едноканален или моно запис, при когото няма фазова разлика за изразяване. Резултатът също влошава стерео широчината на запазеното съдържание. За подкаст запис в шумна стая, отменянето на централния канал е грешният инструмент. Акустично лечение, насочен микрофон или приставка за гейт в специализиран аудио редактор са практическите варианти за фонов шум.

Износ за разпространение: формат, скорост на битовете и моно срещу стерео
Повечето директории за подкасти приемат MP3 и AAC. MP3 е най-съвместимият избор; всеки плейър и платформа го поддържат. AAC при същата скорост на битовете е леко по-ефективен, но изисква поддържан контейнер като .m4a. За едногласов подкаст, 64 kbps моно MP3 е обикновено достатъчен: речта заема тесен честотен диапазон, а монофонията премахва излишеството на канала. Ако предаването ви има музика, звукови ефекти или множество водещи, панорирани за ефект, 128 kbps стерео дава допълнителния резерв. Надхвърлянето на 128 kbps за реч не дава чуваемо подобрение и увеличава размера на файла, което влияе на времето за изтегляне за слушатели при бавни връзки. Епизод от 60 минути при 64 kbps моно е около 28 MB; при 128 kbps стерео е приблизително 56 MB. Смесването до моно преди износ също намалява данните наполовина в сравнение с стерео при същата скорост на битовете. audio-converter обработва избора на формат и скорост на битовете. Задайте честотата на семплиране на 44.1 kHz за съвместимост; 48 kHz е конвенция за видео и не е необходима за разпространение само на аудио.
Правете го локално: без изпращане на файла от устройството ви
audio-volume, vocal-remover и audio-converter всички работят в браузъра с WebAssembly. Аудио обработката се извършва вътре в паметта на браузъра; файлът се чете от локалния ви диск, обработва се изцяло на устройството ви и изходът се предлага като локално изтегляне. Нищо не се изпраща до сървър. Това е важно за производство на подкасти, когато съдържанието е чувствително, интервю, записано преди публикуване, разговор под ембарго или просто запис, който не искате на сървър на трета страна. Същото ограничение се прилага и за ограниченията: инструментите правят това, което имплементацията им поддържа, не повече. audio-volume прилага усиление и нормализиране на силата на звука. vocal-remover прилага отменяне на централния канал. audio-converter конвертира формат и скорост на битовете. Всеки инструмент прави едно определено нещо, а изходът е това, което локалният ви хардуер може да изчисли.
Инструменти от тази статия
- Сила на звукаУсилете, намалете или нормализирайте силата на звука на аудиофайл в браузъра. Без качване.
- Премахване на вокали (караоке)Намалете централно разположените вокали, за да създадете караоке песен, в браузъра. Без качване.
- Конвертор на аудиоКонвертирай аудио в MP3, WAV или AAC директно в браузъра. Без качване.
- Обединяване на аудио файловеКонкатенирай множество аудио файлове (MP3, WAV, M4A, OGG…) в един. Плъзни за пренареждане. Без качване.
Често задавани въпроси
Какво е -16 LUFS и защо е целта за подкасти?
-16 LUFS е интегрираното ниво на силата на звука, към което повечето подкаст приложения и директории нормализират при възпроизвеждане. Изпращането при -16 LUFS означава, че епизодът ви се възпроизвежда приблизително на нивото, което сте предвидили, без платформата да прилага големи автоматични корекции. Стойността идва от стандарта ITU-R BS.1770 за силата на звука при излъчване, адаптиран от Apple Podcasts и Spotify за произносено съдържание.
Може ли vocal-remover да премахне фонов шум от подкаст запис?
Не. vocal-remover прилага отменяне на централния канал, което изважда сигнала, идентичен в двата стерео канала. Фоновият шум в подкаст запис не е централно панориран по начин, по който отменянето може да го насочи, а моно записите нямат разлика в каналите за изразяване. За намаляване на фонов шум, използвайте акустично лечение, насочен микрофон или специализиран инструмент за гейт за шум или спектрален ремонт в аудио редактор.
Трябва ли да изнасям подкаста си в моно или стерео?
За едногласов запис, моно при 64 kbps MP3 е стандартният избор. Той намалява размера на файла наполовина в сравнение с стерео при същата скорост на битовете и няма чуваем недостатък за реч. Използвайте стерео, ако епизодът ви има музика, множество водещи, умишлено панорирани, или звуков дизайн, зависещ от разделянето на каналите.