Wróć do wszystkich kryteriów

1.2.5 Audiodeskrypcja (nagrana) (ang.) Audio Description (Prerecorded)

Specjalizacje:

  • Content Creator
  • Deweloper

Elementy:

  • Multimedia

Poziomy:

  • AA

Spis treści

    Istota i cel kryterium

    Głównym założeniem tej wytycznej na poziomie AA jest zniwelowanie barier odbioru poprzez zapewnienie zsynchronizowanej, mówionej ścieżki opisującej treści wizualne w nagranych materiałach wideo. To kryterium jest rozszerzeniem wymogu 1.2.3.

    Pamiętaj, że audiodeskrypcja musi być przygotowana w tym samym języku naturalnym ((ang.) human language), w którym zrealizowano oryginalną ścieżkę dźwiękową filmu lub w którym przygotowano stronę internetową. Jej zadaniem jest wzbogacenie warstwy dźwiękowej o kluczowe informacje, gdy obraz jest niedostępny. Wykorzystuj naturalne przerwy w dialogach, aby opowiedzieć o akcji, zmianach scenerii, wyglądzie postaci czy napisach pojawiających się na ekranie.

    Dzięki temu technologie wspomagające (np. czytniki ekranu, terminale brajlowskie) mogą odczytać lub przetworzyć te informacje i zaprezentować je użytkownikowi w dostępnej dla niego formie.

    Definicja w j. angielskim

    Definicja dostępna pod adresem (link otworzy się w nowej karcie):
    https://www.w3.org/WAI/WCAG22/quickref/#audio-description-prerecorded

    Definicja w j. polskim

    Definicja dostępna pod adresem (link otworzy się w nowej karcie):
    https://www.w3.org/Translations/WCAG21-pl/#audiodeskrypcja-nagranie

    Słownik pojęć

    Audiodeskrypcja (ang.) audio description
    –

    dodatkowa ścieżka narracyjna wpleciona w naturalne pauzy dialogowe. Jej bezkompromisowym zadaniem jest werbalne zobrazowanie tego, co dzieje się na ekranie – ruchów postaci, mimiki, zmian scenerii czy tekstów wyświetlanych na ekranie, których nikt nie czyta na głos.

    Media zsynchronizowane (ang.) synchronized media
    –

    ścieżka dźwiękowa (audio) lub obraz (wideo) połączone i skoordynowane w czasie z innym formatem prezentacji informacji lub z interaktywnymi komponentami czasowymi. To w praktyce klasyczny materiał wideo z dźwiękiem. Chodzi o sytuację, w której ścieżka audio (np. głos lektora, dialogi) jest ściśle połączona i skoordynowana w czasie z obrazem. To właśnie to połączenie sprawia, że kryterium 1.2.2 staje się aktywne (samo audio bez obrazu nie jest mediami zsynchronizowanymi).

    Wpływ na dostępność (Kogo wspierasz?)

    Wdrażając to kryterium, bezpośrednio wspierasz osoby niewidome oraz słabowidzące. Bez audiodeskrypcji dynamiczna akcja filmu, kluczowa mimika bohaterów czy tekst wyświetlany na ekranie stają się dla nich całkowicie niedostępne.

    Brak opisu wizualnego drastycznie spłyca odbiór, zmieniając oglądanie wideo w chaotyczne słuchanie wyrwanych z kontekstu dialogów. Dzięki temu użytkownicy z dysfunkcjami wzroku mogą bez przeszkód identyfikować postacie, śledzić niuanse fabularne oraz bezbłędnie interpretować niewerbalne komunikaty.

    Zasady wdrażania i wymagania techniczne

    Zadbaj o techniczną perfekcję wdrożenia, wybierając jedną z uznanych, wystarczających technik opisanych w oficjalnej dokumentacji:

    • Dodatkowa, wybieralna ścieżka dźwiękowa: Dostarcz użytkownikowi możliwość samodzielnego włączenia i wyłączenia alternatywnej ścieżki audio zawierającej audiodeskrypcję bezpośrednio z poziomu kontrolek odtwarzacza.
    • Wbudowanie opisu bezpośrednio w główną narrację: Zaplanuj produkcję materiału wideo tak, aby lektor lub prezenter naturalnie wypowiadał i opisywał wszystkie istotne elementy wizualne w trakcie trwania głównego nagrania (rozwiązanie doskonałe m.in. dla prezentacji i szkoleń).
    • Wykorzystanie języków integracji multimediów: Zastosuj technologie takie jak SMIL ((ang.) Synchronized Multimedia Integration Language) do precyzyjnego zsynchronizowania i dostarczenia wersji filmu z audiodeskrypcją za pomocą dedykowanych znaczników).
    • Audiodeskrypcja rozszerzona: Gdy akcja w filmie jest zbyt dynamiczna, a naturalne pauzy w dialogach są niewystarczające do przekazania opisów, zastosuj mechanizm automatycznego zatrzymywania obrazu na czas odtworzenia dłuższej narracji (techniki SM1 lub SM2).
    • Statyczna alternatywa dla prostych wideo : W przypadku materiałów wideo typu „gadająca głowa” ((ang.) talking head video), gdzie na ekranie nie zachodzą żadne istotne interakcje, możesz dostarczyć pełny, statyczny opis tekstowy opisujący osobę i jej otoczenie.

    Wyjątki i sytuacje szczególne

    Jeśli wszystkie istotne informacje przekazywane w ścieżce wizualnej są już w pełni i bezpośrednio wyrażone w standardowej ścieżce dźwiękowej (np. mówca odczytuje dokładnie każdy wyświetlany tekst i opisuje wykonywane czynności), dodatkowa audiodeskrypcja jest całkowicie zbędna i kryterium uznaje się za spełnione. Ponadto wytyczna ta bezwzględnie nie ma zastosowania do mediów nadawanych w czasie rzeczywistym (na żywo).

    Przykłady implementacji

    Najczęstsze błędy

    • F113: Niewykorzystanie istniejących i dostępnych pauz w dialogach do wplecenia audiodeskrypcji dla ważnych, niedających się usłyszeć treści wizualnych.
    • Całkowite zignorowanie kryterium: Publikowanie zsynchronizowanych multimediów zawierających kluczowe, niewerbalne sceny akcji bez jakiejkolwiek formy opisu dźwiękowego.
    • Destrukcyjna synchronizacja: Nakładanie głosu lektora audiodeskrypcji na istotne wypowiedzi bohaterów lub kluczowe dla fabuły efekty dźwiękowe.
    • Brak kontroli po stronie użytkownika: Wdrożenie audiodeskrypcji jako jedynej, niezmiennej i niemożliwej do wyłączenia ścieżki dźwiękowej.
    • Niska, chaotyczna jakość opisów: Tworzenie narracji nazbyt rozwlekłej, subiektywnej lub powtarzającej informacje, które użytkownik słyszy w dialogach.
    • Bezrefleksyjne poleganie na automatach: Stosowanie wyłącznie generowanych automatycznie przez sztuczną inteligencję opisów wideo bez nadzoru i korekty człowieka, co prowadzi do drastycznych błędów interpretacyjnych.

    Najlepsze praktyki

    • Planuj dostępność na etapie przedprodukcji: Twórz scenariusz wideo z myślą o audiodeskrypcji, celowo rezerwując naturalne przerwy w dialogach na późniejszy opis lektorski.
    • Zachowaj absolutny obiektywizm: Opisuj fakty, wygląd i akcję w sposób neutralny, dając użytkownikowi przestrzeń do samodzielnej interpretacji emocjonalnej dzieła.
    • Zadbaj o profesjonalną realizację dźwięku: Nagrywaj ścieżkę lektorską na wysokiej jakości sprzęcie, dbając o czystą, wyraźną i przyjemną intonację głosu.
    • Wykorzystaj zaawansowane możliwości semantyczne: Rozważ implementację elementu <track kind="descriptions"> w kodzie HTML jako formę dostarczenia tekstowej audiodeskrypcji dla użytkowników czytników ekranu (pamiętaj, że technika H96 ma charakter doradczy).
    • Testuj z grupą docelową: Angażuj osoby niewidome i słabowidzące do audytu i oceny jakości przygotowanej audiodeskrypcji przed ostatecznym wdrożeniem.

    Metody testowania

    • Testowanie manualne: Wyłącz monitor lub zamknij oczy, a następnie odsłuchaj cały materiał wideo. Zweryfikuj, czy bez dostępu do obrazu jesteś w stanie bezbłędnie zidentyfikować postacie, śledzić zmiany lokalizacji i w pełni zrozumieć treść. Sprawdź, czy głos lektora nie nakłada się na dialogi.
    • Narzędzie deweloperskie (ang.) Developer Tools: Zbadaj strukturę drzewa DOM elementu <video>. Sprawdź, czy odtwarzacz udostępnia poprawnie zaimplementowane mechanizmy obsługi wielu ścieżek audio lub dynamicznego przełączania alternatywnych plików źródłowych z audiodeskrypcją.

    Sprawdź swoją wiedzę

    W linku poniżej znajduje się 5 modułów z materiałami wideo. Twoim zadaniem jest ocenić, czy każdy wariant zapewnia osobom niewidomym zsynchronizowaną, mówioną ścieżkę (audiodeskrypcję) opisującą kluczowe treści wizualne, zgodnie z wymogami poziomu AA.

    Jak to sprawdzić?

    1. Wyłącz monitor (lub zamknij oczy) i odtwórz nagranie. Oceń, czy rozumiesz, co dokładnie dzieje się na ekranie, korzystając wyłącznie ze słuchu.
    2. Zwróć uwagę, czy lektor/prezenter naturalnie wplata opisy w swoją wypowiedź (zintegrowana audiodeskrypcja).
    3. Jeśli wideo posiada przycisk „D” (Audiodeskrypcja) w odtwarzaczu, włącz go. Sprawdź, czy opisy pojawiają się w odpowiednich momentach i nie zagłuszają dialogów.
    4. Pamiętaj, że na poziomie AA sama alternatywa tekstowa (czytana wzrokiem lub przez screen reader poza odtwarzaczem) nie wystarcza.

    Notatka: Zanim zajrzysz do rozwiązania, przetestuj i zapisz swoje wnioski na kartce.
    Proponowane narzędzia: Wyłączenie monitora, Narzędzie deweloperskie (ang.) Developer Tools

    Link: https://pdc.ambiscale.com/training/wcag-1-2-5/

    #1 BŁĄD

    Problem: Prezenter używa sformułowań typu „tutaj”, „to”, „jak widać” (np. „największa niebieska część”) bez jednoczesnego opisu wizualnego.
    Dlaczego: Osoba niewidoma całkowicie traci kontekst i nie wie, o jakich danych mówi prezenter. Brak audiodeskrypcji sprawia, że wideo oblewa kryterium 1.2.5.
    Naprawa: Należy dodać ścieżkę z audiodeskrypcją lub nagrać wideo ponownie, stosując zintegrowaną audiodeskrypcję (jak w przykładzie #2).


    #2 DOBRZE

    Dlaczego: Zastosowano zintegrowaną audiodeskrypcję. Prezenter w naturalny sposób wplata w swoją wypowiedź opisy tego, co widać na ekranie (odczytuje kluczowe dane z wykresu). Dzięki temu dodatkowa ścieżka dźwiękowa nie jest potrzebna, a osoba niewidoma ma pełny dostęp do informacji.


    #3 BŁĄD

    Problem: Film posiada jedynie tekstowy opis pod spodem. Brak mówionej audiodeskrypcji.
    Dlaczego: Sama alternatywa tekstowa pod filmem jest wystarczająca dla kryterium 1.2.3 (poziom A), ale nie spełnia kryterium 1.2.5 (poziom AA). Poziom AA wymaga, aby audiodeskrypcja była zsynchronizowaną ścieżką dźwiękową (mówioną), której można słuchać w trakcie oglądania filmu.
    Naprawa: Dodaj ścieżkę audiodeskrypcji (np. plik VTT z kind="descriptions") lub udostępnij osobną wersję filmu z wgranym lektorem.


    #4 DOBRZE

    Dlaczego: Zastosowano ścieżkę <track kind="descriptions">, którą odtwarzacz AblePlayer odczytuje na głos, wykorzystując syntezator mowy przeglądarki (Web Speech API). Zapewnia to mówioną alternatywę dla treści wizualnych.
    Ważne zastrzeżenie: technika oparta na elemencie <track> (H96) ma w WCAG charakter doradczy, a nie wystarczający — natywne przeglądarki nie odczytują ścieżek opisów, więc działa to wyłącznie w odtwarzaczu takim jak AblePlayer. Formalnie pewniejsze techniki poziomu AA to osobna, wybieralna ścieżka audio (G78) lub osobna wersja filmu z wgraną audiodeskrypcją (G173 — jak w #5).


    #5 DOBRZE

    Dlaczego: Udostępniono wyraźny i łatwo dostępny link do osobnej wersji filmu, w której ścieżka lektorska z audiodeskrypcją jest na stałe wgrana w dźwięk (tzw. open audio description). Jest to w pełni poprawna i bezpieczna technika spełnienia kryterium 1.2.5.

    Źródła

    Wróć do wszystkich kryteriów