Χωρίς μεταφόρτωση, 100% τοπικά, χωρίς λογαριασμό

Άρθρο

Καθαρισμός και προετοιμασία ήχου για podcast

Μια ακατέργαστη εγγραφή φωνής χρειάζεται συνήθως τρία πράγματα πριν είναι έτοιμη για δημοσίευση: σταθερό επίπεδο έντασης, μορφή και bitrate που αναμένουν οι πλατφόρμες streaming, και έντιμη αξιολόγηση του τι μπορεί πραγματικά να προσφέρει η αφαίρεση θορύβου. Αυτό το άρθρο καλύπτει αυτά τα βήματα χρησιμοποιώντας το audio-volume, το vocal-remover και το audio-converter, όλα εκτελούμενα τοπικά στον περιηγητή.

Loudness έναντι peak: γιατί το LUFS έχει μεγαλύτερη σημασία από το peak level

Το peak level μετρά το μεμονωμένο πιο δυνατό δείγμα σε ένα αρχείο ήχου. Το loudness, εκφρασμένο σε LUFS (Loudness Units relative to Full Scale), μετρά την αντιληπτή ενέργεια στον χρόνο. Ένα podcast εγγεγραμμένο στα -3 dBFS peak μπορεί ακόμα να ακούγεται ήσυχο αν το μεγαλύτερο μέρος του σήματος βρίσκεται πολύ χαμηλότερα. Οι πλατφόρμες streaming και οι κατάλογοι podcast κανονικοποιούν τον ήχο σε τιμή στόχο loudness κατά την αναπαραγωγή, συνήθως -14 LUFS για υπηρεσίες μουσικής και -16 LUFS για ομιλημένο λόγο, οπότε η υποβολή σε πολύ διαφορετικό επίπεδο σημαίνει ότι η πλατφόρμα θα ανεβάσει ή κατεβάσει τον ήχο σας ούτως ή άλλως. Ο στόχος -16 LUFS integrated loudness σας δίνει ένα τελικό αρχείο που ταιριάζει με την προεπιλογή της πλατφόρμας, παραμένει συνεπές με άλλα shows και αφήνει λίγο headroom πριν από το ψηφιακό ανώτατο όριο στα 0 dBFS. Το true peak, που λαμβάνει υπόψη overs μεταξύ δειγμάτων, διατηρείται συνήθως κάτω από -1 dBTP. Η στόχευση αυτών των δύο τιμών μαζί δίνει καθαρότερο αποτέλεσμα από το να κυνηγάτε μόνο ένα peak target.

Άτομο που φοράει ακουστικά και ηχογραφεί podcast, μιλώντας σε επιτραπέζιο μικρόφωνο μπροστά σε υπολογιστή
Photo: Guillaume Bonzoms, CC0, via Wikimedia Commons

Gain και κανονικοποίηση με το audio-volume

Το audio-volume σας επιτρέπει να ρυθμίσετε το gain ενός αρχείου σε decibel ή να εφαρμόσετε κανονικοποίηση loudness. Αν μια εγγραφή είναι συνεχώς ήσυχη, η προσθήκη gain σε dB ανεβάζει ολόκληρο το σήμα κατά σταθερό ποσό. Ο κίνδυνος είναι clipping: αν κάποιο peak βρίσκεται ήδη κοντά στα 0 dBFS, μια θετική μετατόπιση gain θα το υπερβεί, εισάγοντας ψηφιακή παραμόρφωση. Ελέγξτε την κυματομορφή πριν εφαρμόσετε gain, και κρατήστε το true peak κάτω από -1 dBFS μετά τη ρύθμιση. Η κανονικοποίηση loudness ακολουθεί διαφορετική προσέγγιση. Το εργαλείο εκτελεί το φίλτρο loudnorm του FFmpeg στον προεπιλεγμένο στόχο του, -24 LUFS integrated loudness, αντί για τους πιο δυνατούς στόχους που συνιστούν ορισμένες πλατφόρμες podcast. Το loudnorm ενός περάσματος είναι μια δυναμική διαδικασία, όχι μια επίπεδη μετατόπιση gain: παρακολουθεί τη δυνατότητα στον χρόνο και προσαρμόζει το σήμα ώστε να συγκλίνει στον στόχο, κάτι που μπορεί να συμπεριφέρεται λίγο σαν ελαφριά συμπίεση δυναμικού εύρους σε μια ασυνεπή εγγραφή. Για εγγραφή φωνής με μεγάλες διακυμάνσεις επιπέδου μεταξύ προτάσεων, ένας αφιερωμένος compressor ή limiter που εφαρμόζεται πριν την κανονικοποίηση εξακολουθεί να δίνει πιο ελεγχόμενο αποτέλεσμα, αλλά αυτά τα βήματα ξεφεύγουν από όσα χειρίζεται το audio-volume.

Τι μπορεί και τι δεν μπορεί να κάνει η ακύρωση center channel

Το vocal-remover εφαρμόζει τεχνική ακύρωσης center channel. Σε ένα stereo αρχείο, ένα σήμα που εμφανίζεται ταυτόσημα και στα αριστερά και στα δεξιά κανάλια με το ίδιο επίπεδο και φάση λέγεται ότι είναι center-panned. Η αφαίρεση του δεξιού καναλιού από το αριστερό αφαιρεί ό,τι βρίσκεται σε αυτήν την κεντρική θέση, αφήνοντας κυρίως το περιεχόμενο που είναι panned στα πλάγια. Αυτό δημιουργεί το εφέ καραόκε σε εμπορικά κυκλοφορημένα μουσικά κομμάτια όπου οι κύριες φωνητικές γραμμές είναι συνήθως center-panned. Δεν ανιχνεύει ούτε διαχωρίζει φωνές χρησιμοποιώντας κανένα μοντέλο ομιλίας. Δεν αφαιρεί θόρυβο φόντου, αντήχηση χώρου, βουητό κλιματισμού ή κυκλοφορία. Δεν απομονώνει τη φωνή του podcast σας από τον ήχο περιβάλλοντος σε εγγραφή ενός καναλιού ή mono, όπου δεν υπάρχει διαφορά φάσης για εκμετάλλευση. Το αποτέλεσμα επίσης υποβαθμίζει το stereo εύρος στο διατηρούμενο περιεχόμενο. Για ένα κομμάτι podcast εγγεγραμμένο σε θορυβώδη αίθουσα, η ακύρωση center channel είναι το λάθος εργαλείο. Η ακουστική επεξεργασία, ένα κατευθυντικό μικρόφωνο ή ένα gate plugin σε ειδικό πρόγραμμα επεξεργασίας ήχου είναι οι πρακτικές επιλογές για θόρυβο φόντου.

Διάγραμμα stereo αρχείου ήχου με αριστερό και δεξί κανάλι εμφανισμένα ξεχωριστά. Το center-panned σήμα είναι ταυτόσημο και στα δύο κανάλια και αφαιρείται, αφήνοντας το περιεχόμενο που είναι panned στα πλάγια.

Εξαγωγή για διανομή: μορφή, bitrate και mono έναντι stereo

Οι περισσότεροι κατάλογοι podcast δέχονται MP3 και AAC. Το MP3 είναι η πιο συμβατή επιλογή. Κάθε αναπαραγωγέας και πλατφόρμα το υποστηρίζει. Το AAC στο ίδιο bitrate είναι ελαφρώς πιο αποδοτικό αλλά απαιτεί υποστηριζόμενο container όπως .m4a. Για podcast μίας φωνής, 64 kbps mono MP3 είναι γενικά αρκετό: η ομιλία καλύπτει στενό φασματικό εύρος, και το mono αφαιρεί οποιαδήποτε πλεονάζοντα δεδομένα καναλιού. Αν το show σας έχει μουσική, ηχητικά εφέ ή πολλαπλούς παρουσιαστές panned για εφέ, τα 128 kbps stereo δίνουν επιπλέον headroom. Η αύξηση πάνω από 128 kbps για ομιλία δεν δίνει ακουστή βελτίωση και αυξάνει το μέγεθος αρχείου, κάτι που επηρεάζει τον χρόνο λήψης για ακροατές με αργές συνδέσεις. Ένα επεισόδιο 60 λεπτών στα 64 kbps mono είναι περίπου 28 MB. Στα 128 kbps stereo είναι περίπου 56 MB. Η μείξη σε mono πριν από την εξαγωγή μειώνει επίσης τα δεδομένα στο μισό σε σύγκριση με το stereo στο ίδιο bitrate. Το audio-converter χειρίζεται την επιλογή μορφής και bitrate. Ορίστε τον ρυθμό δειγματοληψίας στα 44.1 kHz για συμβατότητα. Τα 48 kHz είναι συνθήκη βίντεο και δεν απαιτούνται για διανομή μόνο ήχου.

Τοπική επεξεργασία: κανένα αρχείο δεν αποχωρεί από τη συσκευή σας

Το audio-volume, το vocal-remover και το audio-converter εκτελούνται όλα στον περιηγητή χρησιμοποιώντας WebAssembly. Η επεξεργασία ήχου γίνεται μέσα στη μνήμη του περιηγητή. Το αρχείο διαβάζεται από τον τοπικό δίσκο σας, επεξεργάζεται εξ ολοκλήρου στη συσκευή σας και η έξοδος προσφέρεται ως τοπική λήψη. Δεν αποστέλλεται τίποτε σε κανέναν διακομιστή. Αυτό έχει σημασία για podcast παραγωγή όταν το περιεχόμενο είναι ευαίσθητο: συνέντευξη εγγεγραμμένη πριν από τη δημοσίευση, συνομιλία υπό εμπάργκο ή απλώς εγγραφή που δεν θέλετε σε διακομιστή τρίτου. Ο ίδιος περιορισμός ισχύει για τους δυνατότητες: τα εργαλεία κάνουν ό,τι υποστηρίζει η υλοποίησή τους, όχι παραπάνω. Το audio-volume εφαρμόζει gain και κανονικοποίηση loudness. Το vocal-remover εφαρμόζει ακύρωση center channel. Το audio-converter μετατρέπει μορφή και bitrate. Κάθε εργαλείο κάνει ένα συγκεκριμένο πράγμα, και η έξοδος είναι ό,τι μπορεί να υπολογίσει το τοπικό σας υλικό.

Εργαλεία αυτού του άρθρου

Συχνές ερωτήσεις

Τι είναι τα -16 LUFS και γιατί είναι ο στόχος για podcasts;

Τα -16 LUFS είναι το επίπεδο integrated loudness στο οποίο κανονικοποιούν κατά την αναπαραγωγή τα περισσότερα podcast apps και κατάλογοι. Η υποβολή στα -16 LUFS σημαίνει ότι το επεισόδιό σας αναπαράγεται περίπου στο επίπεδο που σκοπεύατε χωρίς η πλατφόρμα να εφαρμόζει μεγάλες αυτόματες διορθώσεις. Η τιμή προέρχεται από το πρότυπο ITU-R BS.1770 για loudness εκπομπής, προσαρμοσμένο από το Apple Podcasts και το Spotify για ομιλημένο περιεχόμενο.

Μπορεί το vocal-remover να αφαιρέσει θόρυβο φόντου από την εγγραφή podcast μου;

Όχι. Το vocal-remover εφαρμόζει ακύρωση center channel, που αφαιρεί το σήμα που είναι ταυτόσημο και στα δύο stereo κανάλια. Ο θόρυβος φόντου σε εγγραφή podcast δεν είναι center-panned κατά τρόπο που μπορεί να στοχεύσει η ακύρωση, και οι mono εγγραφές δεν έχουν καμία διαφορά καναλιού για εκμετάλλευση. Για μείωση θορύβου φόντου, χρησιμοποιήστε ακουστική επεξεργασία, κατευθυντικό μικρόφωνο ή ειδικό εργαλείο noise gate ή spectral repair σε πρόγραμμα επεξεργασίας ήχου.

Να εξάγω το podcast μου σε mono ή stereo;

Για εγγραφή μίας φωνής, mono στα 64 kbps MP3 είναι η τυπική επιλογή. Μειώνει το μέγεθος αρχείου στο μισό σε σχέση με stereo στο ίδιο bitrate και δεν έχει ακουστό μειονέκτημα για ομιλία. Χρησιμοποιήστε stereo αν το επεισόδιό σας έχει μουσική, πολλαπλούς παρουσιαστές σκόπιμα panned ή ηχητικό σχεδιασμό που εξαρτάται από διαχωρισμό καναλιών.