Jaki stopień zmniejszenia pliku źródłowego WAV oferują formaty kompresji stratnej, przy zachowaniu akceptowalnej jakości dźwięku?
Formaty kompresji stratnej, takie jak MP3, AAC czy OGG Vorbis, zostały stworzone właśnie po to, żeby znacząco redukować rozmiary plików audio, a przy tym utrzymać akceptowalną jakość dźwięku. Gdy mamy do czynienia z plikiem WAV (który zazwyczaj jest nieskompresowany i zajmuje sporo miejsca – na przykład typowe 3-minutowe nagranie stereo 44,1 kHz/16 bit to ponad 30 MB), użycie dobrego kodeka stratnego pozwala zejść z rozmiarem do ok. 3 MB. Z mojego doświadczenia – zarówno przy projektach muzycznych, jak i podczas przygotowywania podcastów – stosuje się najczęściej bitrate na poziomie 128-192 kbps, co daje właśnie około dziesięciokrotną redukcję w stosunku do oryginału. Oczywiście, im wyższy bitrate, tym większy plik i lepsza jakość, ale właśnie 10x jest taką sensowną średnią, przy której większość ludzi nie słyszy większej różnicy w typowym sprzęcie. Standardy branżowe, na przykład w streamingach czy archiwizacji nagrań do internetu, bardzo często opierają się na tej proporcji. Praktycznym przykładem jest przesyłanie utworów do serwisów streamingowych – pliki muszą być jak najmniejsze przy zachowaniu jakości, bo to po prostu opłacalne i wygodne. Moim zdaniem, jeśli ktoś zawodowo obrabia dźwięk, to doskonale zna tę zasadę i zawsze balansuje między jakością a optymalnym rozmiarem pliku.
Oceniając skuteczność kompresji stratnej, łatwo popełnić błąd w szacowaniu jej możliwości – szczególnie, kiedy nie ma się jeszcze dużego doświadczenia z praktycznym zastosowaniem różnych formatów audio czy znajomości standardów branżowych. Często spotykam się z przekonaniem, że pliki po kompresji stratnej, takiej jak MP3 czy AAC, są tylko nieznacznie mniejsze od oryginału WAV – to jednak nieprawda. Kompresja stratna działa zupełnie inaczej niż bezstratna i pozwala na drastyczne zmniejszenie rozmiaru pliku. Myślenie, że uzyskamy mniej niż dwukrotną czy nawet pięciokrotną redukcję, wynika zwykle z niezrozumienia zasady działania kodeków stratnych, które celowo odrzucają dane niesłyszalne lub mało istotne dla percepcji człowieka. Oczywiście, można by teoretyzować o jeszcze większych oszczędnościach, typu ponad dwudziestokrotne zmniejszenie – tutaj jednak pojawia się problem ze zbyt niską jakością dźwięku, która przestaje być akceptowalna nawet dla mniej wymagającego ucha. Najlepsze praktyki pokazują, że optymalny kompromis między oszczędnością miejsca a zachowaniem jakości to właśnie okolice dziesięciokrotnej redukcji rozmiaru. Takie proporcje są stosowane na co dzień w muzycznych serwisach streamingowych czy przy przesyłaniu podcastów w internecie. Przyjęcie założenia, że możliwości kompresji stratnej są dużo mniejsze lub dużo większe, prowadzi do błędów w doborze formatu audio do konkretnego zastosowania, zwłaszcza kiedy liczy się zarówno jakość, jak i pojemność czy szybkość transferu. Warto pamiętać, że technologia kompresji stratnej to kompromis – chodzi o to, żeby zachować jak najwięcej jakości przy jednoczesnym radykalnym zmniejszeniu rozmiaru pliku, ale bez przesady w żadną stronę. Moim zdaniem, świadomość tego mechanizmu jest kluczowa w pracy z dźwiękiem, szczególnie jeśli ktoś planuje dystrybucję nagrań w sieci czy archiwizację dużych bibliotek audio.