Wróć do wszystkich kryteriów

1.2.1 Tylko audio i tylko wideo (nagrane) (ang.) Audio-only and Video-only (Prerecorded)

Specjalizacje:

  • Content Creator
  • Designer
  • Deweloper

Elementy:

  • Multimedia

Poziomy:

  • A

Spis treści

    Istota i cel kryterium

    Kryterium to nakłada obowiązek zapewnienia alternatywnych sposobów odbioru informacji dla samodzielnych materiałów dźwiękowych lub wizualnych. Brak takich alternatyw stanowi uchybienie, które ogranicza użytkownikom z niepełnosprawnościami dostęp do kluczowych danych. Wdrożenie tej wytycznej gwarantuje, że cyfrowe media nie staną się barierą, lecz będą w pełni przyswajalne niezależnie od dysfunkcji wzroku czy słuchu.

    Realizacja tego kryterium polega na dostarczeniu równoważnego nośnika informacji – odpowiednio tekstu dla plików audio lub ścieżki dźwiękowej/opisu dla plików video. Dzięki temu eliminujesz wykluczenie informacyjne i dajesz użytkownikom pełną wolność wyboru formatu konsumpcji treści.

    Definicja w j. angielskim

    Definicja dostępna pod adresem (link otworzy się w nowej karcie):
    https://www.w3.org/WAI/WCAG22/quickref/#audio-only-and-video-only-prerecorded

    Definicja w j. polskim

    Definicja dostępna pod adresem (link otworzy się w nowej karcie):
    https://www.w3.org/Translations/WCAG21-pl/#tylko-audio-lub-tylko-wideo-nagranie

    Słownik pojęć

    Materiały nagrane wcześniej (ang.) prerecorded media
    –

    treści multimedialne opublikowane i udostępnione użytkownikowi po ich uprzedniej rejestracji i montażu, w przeciwieństwie do transmisji realizowanych w czasie rzeczywistym.

    Tylko audio (ang.) audio-only
    –

    samodzielne nagranie dźwiękowe, które nie zawiera zsynchronizowanej ścieżki wizualnej ani innych form graficznych przekazujących treść (np. podcasty, nagrane wykłady).

    Tylko wideo (ang.) video-only
    –

    samodzielna, niema prezentacja obrazu lub animacja, pozbawiona jakiejkolwiek powiązanej narracji dźwiękowej czy dialogów (np. niemy pokaz slajdów, instrukcja montażu bez fonii).

    Alternatywa tekstowa (ang.) text alternative
    –

    Tekst programowo powiązany z treścią nietekstową, który przekazuje jej pełne znaczenie lub funkcję. Pozwala technologiom wspomagającym na udostępnienie informacji osobom, które nie widzą lub nie słyszą oryginalnego elementu.

    Alternatywa dla mediów opartych na czasie (ang.) alternative for time-based media
    –

    dokument tekstowy zawierający ustrukturyzowane, uporządkowane w czasie opisy wydarzeń wizualnych i dźwiękowych oraz dialogów.

    Alternatywa multimedialna dla tekstu (ang.) media alternative for text
    –

    multimedia, które prezentują dokładnie te same informacje, co tekst znajdujący się bezpośrednio na stronie, służące jako alternatywna forma zapoznania się z treścią.

    Wpływ na dostępność (Kogo wspierasz?)

    • Użytkowników z zaburzeniami poznawczymi: Tekst pozwala im na przetwarzanie złożonych informacji we własnym, komfortowym tempie. Mogą wielokrotnie wracać do trudniejszych fragmentów, co drastycznie zmniejsza zmęczenie psychiczne i eliminuje lęk przed pominięciem ważnego wątku.
    • Użytkowników niesłyszących oraz słabosłyszących: Dla tej grupy osób samodzielny plik dźwiękowy bez transkrypcji jest całkowicie bezużyteczny. Precyzyjna transkrypcja tekstowa staje się dla nich jedynym oknem na świat i jedynym sposobem dotarcia do zawartości podcastu czy audycji.
    • Osoby w sytuacjach ograniczających (bariery środowiskowe i techniczne): Wspierasz internautów przeglądających treści w głośnym otoczeniu (np. w komunikacji miejskiej bez słuchawek) lub w strefie ciszy, gdzie odtwarzanie dźwięku jest niemożliwe. Pomagasz także osobom z niską przepustowością sieci, dla których strumieniowanie ciężkich plików wideo jest barierą techniczną – tekst ładuje się błyskawicznie.
    • Użytkowników niewidomych i słabowidzących: Osoby te nie są w stanie odebrać niemych demonstracji, wykresów czy wizualizacji danych w plikach tylko wideo. Szczegółowe opisy tekstowe lub profesjonalna audiodeskrypcja przywracają im pełny kontekst i pozwalają bezbłędnie zrozumieć przekaz.
    • Wszyscy odbiorcy oraz roboty wyszukiwarek: Tekstowe odpowiedniki wybitnie wspomagają indeksowanie SEO. Pozwalają algorytmom wyszukiwarek precyzyjnie przeszukiwać zawartość multimediów, co zwiększa zasięg Twoich materiałów.

    Zasady wdrażania i wymagania techniczne

    Podczas implementacji multimediów bezwzględnie przestrzegaj standardów technicznych, które zapewnią wyrazistość bez kompromisów.

    Zastosuj się do poniższych wytycznych wykonawczych:

    Dla materiałów typu tylko wideo:

    • Zapewnij ekwiwalent tekstowy lub dźwiękowy: Przygotuj szczegółowy scenariusz, tekst opisujący elementy wizualne albo dodaj zsynchronizowaną ścieżkę audiodeskrypcji, która precyzyjnie objaśnia dynamiczne działania na ekranie dla osób niewidomych.
    • Zadbaj o maksymalną szczegółowość: Opisuj wszystkie kluczowe dane, zachowania i relacje przestrzenne. Jeśli wideo przedstawia skomplikowane procesy lub infografiki, Twój opis musi bezbłędnie wyjaśniać te zależności.

    Dla materiałów typu tylko audio:

    • Przygotuj kompletną transkrypcję: Stwórz wierny zapis tekstowy zawierający nie tylko same dialogi, ale też kluczowe odgłosy otoczenia i efekty dźwiękowe istotne dla kontekstu (np. „śmiech”, „muzyka w tle”, „dźwięk dzwonka”).
    • Zweryfikuj dokładność zapisu: Upewnij się, że tekst jest pozbawiony błędów merytorycznych i w pełni oddaje intencje autorów nagrania dźwiękowego.

    Ogólne wymagania architektoniczne i semantyczne:

    • Używaj semantycznych tagów strukturalnych: Zawsze osadzaj multimedia za pomocą natywnych elementów HTML5 – znaczników <audio> oraz <video>.
    • Powiąż multimedia z alternatywą za pomocą kodu: Wykorzystaj zaawansowane atrybuty dostępności, takie jak aria-describedby, aby w strukturze drzewa DOM jednoznacznie połączyć odtwarzacz z kontenerem zawierającym transkrypcję lub opis.
    • Gwarantuj łatwą lokalizację: Umieść alternatywę bezpośrednio pod odtwarzaczem na tej samej stronie lub udostępnij doskonale widoczny, jednoznaczny link prowadzący do dedykowanego pliku bądź podstrony. Zawsze wyraźnie informuj użytkownika o obecności tego udogodnienia.
    • Dostarczaj pełnowartościową treść: Pamiętaj, że alternatywa musi przekazywać w 100% równoważne informacje. Całkowicie unikaj tworzenia powierzchownych skrótów czy lakonicznych, ogólnych podsumowań.

    Wyjątki i sytuacje szczególne

    Kryterium 1.2.1 nie jest bezwzględne w każdym przypadku:

    • Multimedia jako alternatywa dla tekstu: Jeśli Twoje wideo lub audio służy wyłącznie jako dodatkowa, przystępniejsza forma tekstu już obecnego na stronie i jest to jasno oznaczone, nie musisz tworzyć dla niego kolejnej alternatywy.
    • Transmisje na żywo: Opisywana reguła dotyczy wyłącznie materiałów zarejestrowanych wcześniej. Media nadawane w czasie rzeczywistym (np. streaming audio lub wideo na żywo) są całkowicie wyłączone z tego kryterium – podlegają pod kryterium 1.2.9.

    Przykłady implementacji

    Najczęstsze błędy (Failures)

    Unikaj tych powszechnych uchybień:

    • F30: Stosowanie rzekomych alternatyw tekstowych, które w rzeczywistości nie przekazują żadnej merytorycznej zawartości pliku, takich jak nazwy plików (np. wyklad_profesora.mp3) lub generyczne teksty zastępcze (np. odtwarzacz audio, plik wideo).
    • F67: Dostarczenie długiego opisu lub transkrypcji dla treści multimedialnych, które nie spełniają tego samego celu lub nie prezentują tych samych istotnych informacji, co oryginalne nagranie (np. powierzchowne streszczenie złożonego procesu wizualnego zamiast precyzyjnego opisu danych i relacji przestrzennych).
    • Publikowanie podcastów i audycji bez transkrypcji: Całkowite zignorowanie warstwy tekstowej dla plików dźwiękowych, co trwale odcina osoby niesłyszące od zawartości.
    • Pozostawianie niemych instrukcji wideo bez komentarza: Udostępnianie filmów instruktażowych (np. demonstracji montażu mebli czy obsługi oprogramowania bez fonii) bez jakiegokolwiek skryptu opisowego lub ścieżki lektorskiej.
    • Bezgraniczne ufanie automatycznym generatorom: Opieranie dostępności wyłącznie na napisach lub transkrypcjach generowanych automatycznie przez sztuczną inteligencję, bez przeprowadzenia rzetelnej, ręcznej korekty błędów kontekstowych.
    • Rozbieżność informacyjna po aktualizacji: Zmiana lub odświeżenie pliku źródłowego przy jednoczesnym pozostawieniu starej, całkowicie nieadekwatnej wersji transkrypcji tekstowej.

    Najlepsze praktyki

    • Różnicuj formaty dostępu do treści: Zapewniaj alternatywy tekstowe w kilku wariantach. Doskonałym podejściem jest umieszczenie kodu HTML bezpośrednio na stronie oraz zaoferowanie estetycznego, łatwego do pobrania pliku PDF.
    • Wykonuj skrupulatną korektę manualną: Każda transkrypcja automatyczna musi przejść przez proces ludzkiej weryfikacji. Poprawiaj błędy językowe, dopasowuj kontekst i dbaj o idealną spójność intencji.
    • Perfekcyjnie opisuj złożoną grafikę: Kiedy Twoje wideo operuje na skomplikowanych wykresach, schematach blokowych czy procesach, twórz opisy o najwyższym stopniu szczegółowości, objaśniające wszelkie zależności między danymi.
    • Dbaj o natychmiastową synchronizację: Wprowadź procedurę, według której każda modyfikacja materiału multimedialnego wymusza jednoczesne naniesienie zmian w odpowiadającym mu tekście alternatywnym.

    Metody testowania

    • Testowanie manualne: Odłącz głośniki lub całkowicie wycisz system, a następnie spróbuj zapoznać się z materiałem typu tylko wideo, opierając się wyłącznie na dostarczonym opisie. W przypadku plików wyłącznie audio, przeczytaj transkrypcję i oceń, czy bez odsłuchu posiadasz w 100% komplet informacji.
    • Narzędzie deweloperskie (ang.) Developer Tools: Otwórz strukturę drzewa DOM w przeglądarce i zweryfikuj, czy znaczniki <audio> i <video> zawierają poprawnie zaimplementowany atrybut aria-describedby wskazujący na unikalny identyfikator kontenera z transkrypcją oraz upewnij się, czy kontener ten nie jest pusty.
    • NVDA: Uruchom czytnik ekranu i przetestuj stronę bez patrzenia na monitor. Upewnij się, że syntezator mowy płynnie i bez przeszkód odczytuje pełną treść alternatywy tekstowej oraz powiązane instrukcje obsługi odtwarzacza.
    • ANDI.JS: Wybierz moduł dedykowany elementom graficznym lub multimedialnym, aby precyzyjnie sprawdzić, jakie alternatywne dane tekstowe są przekazywane do technologii wspomagających i czy system widzi je w prawidłowym kontekście.
    • (ang.) WAVE Evaluation Tool: Przeprowadź automatyczną weryfikację struktury strony pod kątem wykrywania ewentualnych błędów w hierarchii nagłówków wewnątrz sekcji transkrypcji oraz poprawności powiązań semantycznych elementów multimedialnych.
    • (ang.) IBM Equal Access Toolkit: Wykonaj kompleksowy audyt komponentów multimedialnych, aby upewnić się, że obecność dodatkowych ścieżek opisowych lub powiązań z transkrypcjami jest prawidłowo raportowana i w pełni dostępna dla mechanizmów asystujących.

    Sprawdź swoją wiedzę

    W linku poniżej znajduje się 6 modułów z prawdziwymi, nagranymi wcześniej materiałami: podcastami (tylko audio) oraz niemą animacją (tylko wideo). Twoim zadaniem jest sprawdzenie, czy każdy materiał posiada pełnowartościową alternatywę, która przekazuje 100% równoważnych informacji.

    Jak to sprawdzić?

    1. Dla materiałów tylko audio: przeczytaj tekst alternatywny i oceń, czy bez odsłuchu posiadasz komplet informacji. Następnie odtwórz nagranie i porównaj treści.
    2. Dla materiałów tylko wideo: nie patrz na ekran (lub obejrzyj wideo dopiero po lekturze) i oceń, czy sam opis pozwala zrozumieć całą akcję, detale i relacje przestrzenne.
    3. W narzędziach deweloperskich (DevTools) możesz dodatkowo zweryfikować, czy odtwarzacz jest programowo powiązany z alternatywą atrybutem aria-describedby.
    4. Pamiętaj o wyjątkach: media będące wyraźnie oznaczoną alternatywą dla tekstu obecnego na stronie oraz transmisje na żywo nie podlegają temu kryterium.

    Notatka: Zanim zajrzysz do rozwiązania, przetestuj i zapisz swoje wnioski na kartce.
    Proponowane narzędzia: Narzędzie deweloperskie (ang.) Developer Tools

    Link: https://pdc.ambiscale.com/training/wcag-1-2-1/

    #1 BŁĄD

    Problem: Jedyną „alternatywą” dla podcastu jest wyświetlona nazwa pliku (Wiecej_niz_Jeden_Zmysl_final_v2.mp3).
    Dlaczego: To klasyczna technika niepowodzenia F30 – rzekoma alternatywa tekstowa, która nie przekazuje żadnej merytorycznej zawartości nagrania. Osoba niesłysząca w żaden sposób nie dowie się, o czym rozmawiali prowadzący; nazwa pliku nie zastępuje treści.
    Naprawa: Dodaj pod odtwarzaczem pełną transkrypcję zawierającą dialogi oraz opisy istotnych dźwięków tła i powiąż ją z odtwarzaczem atrybutem aria-describedby (jak w przykładzie #2).


    #2 DOBRZE

    Dlaczego: Materiał tylko audio otrzymał wzorcową alternatywę:

    • pełna transkrypcja obejmuje nie tylko dialogi, ale też opisy dźwięków (intro, przerywnik, outro), dzięki czemu przekazuje 100% równoważnych informacji,
    • kontener transkrypcji to nazwany region (role="region", aria-label, tabindex="0") programowo powiązany z odtwarzaczem przez aria-describedby,
    • dodatkowo zaoferowano drugi format dostępu – czytelnie opisany link do pliku PDF (z informacją o formacie i rozmiarze).

    #3 BŁĄD

    Problem: Nieme wideo posiada opis, ale jest nim jedno lakoniczne zdanie: „Na filmie pokazany jest królik i łąka.”.
    Dlaczego: To technika niepowodzenia F67 – dostarczony opis nie prezentuje tych samych istotnych informacji, co oryginalne nagranie. Powierzchowne streszczenie pomija całą akcję (badanie terenu, drapanie się, przelot motyla), detale wyglądu i relacje przestrzenne. Osoba niewidoma otrzymuje ułamek treści, którą widzi osoba oglądająca.
    Naprawa: Przygotuj szczegółowy, ustrukturyzowany opis wszystkich zdarzeń wizualnych (najlepiej z osiami czasu, jak w przykładzie #4).


    #4 DOBRZE

    Dlaczego: Materiał tylko wideo posiada pełnowartościowy ekwiwalent tekstowy: opis z osiami czasu relacjonuje sekunda po sekundzie całą akcję, wygląd bohaterów, tło i relacje przestrzenne („z lewej strony kadru”, „przelatuje w prawą stronę”). Odtwarzacz jest powiązany z opisem przez aria-describedby, a dodatkowo podłączono zsynchronizowaną ścieżkę opisową (<track kind="descriptions">), z której mogą skorzystać odtwarzacze wspierające audiodeskrypcję.


    #5 BŁĄD

    Problem: Transkrypcja opisuje zupełnie inny odcinek (o kontraście kolorów i narzędziu Colour Contrast Analyser), podczas gdy w nagraniu prowadzący mówią o kryteriach percepcji i zmysłach.
    Dlaczego: To rozbieżność informacyjna – typowy skutek podmiany lub aktualizacji pliku źródłowego bez zaktualizowania tekstu. Alternatywa, która nie prezentuje tych samych informacji co nagranie, nie spełnia swojego celu (technika niepowodzenia F67). Osoba niesłysząca otrzymuje fałszywy obraz treści, co bywa gorsze niż brak transkrypcji, bo odbiera jej szansę zorientowania się w pomyłce.
    Naprawa: Wprowadź procedurę synchronizacji: każda modyfikacja materiału multimedialnego musi wymuszać jednoczesną aktualizację transkrypcji. Przed publikacją porównaj tekst z faktyczną zawartością nagrania.


    #6 DOBRZE

    Dlaczego: Nagranie audio nie wymaga tutaj transkrypcji, ponieważ samo jest alternatywą dla tekstu – pełna treść znajduje się w artykule bezpośrednio na stronie, a nagranie zostało wyraźnie oznaczone jako jego wersja audio przekazująca dokładnie te same informacje. Kryterium 1.2.1 wprost przewiduje ten wyjątek: multimedia będące jasno opisaną, przystępniejszą formą tekstu obecnego na stronie nie potrzebują kolejnej alternatywy. Gdyby jednak etykieta zniknęła albo nagranie zawierało więcej informacji niż artykuł, wyjątek przestałby obowiązywać. Analogicznie poza zakresem 1.2.1 pozostają transmisje na żywo – media nadawane w czasie rzeczywistym podlegają kryterium 1.2.9, nie 1.2.1.

    Źródła

    Wróć do wszystkich kryteriów