Så ser en WCAG-anpassad poddtranskription ut (med mall)

Här får du kraven, en färdig mall du kan kopiera, och placeringstricket som sätter din transkription framför varje poddapp.

Varför transkriptioner krävs — kortversionen

Kravet kommer från WCAG 2.1, framgångskriterium 1.2.1 (nivå A): förinspelat innehåll som enbart består av ljud måste ha ett textalternativ som förmedlar likvärdig information. För en podd är det textalternativet i praktiken en transkription.

Det här har juridisk betydelse eftersom WCAG 2.1 AA är den tekniska standard som — via EN 301 549 — ligger inbäddad i tillgänglighetsdirektivet, i kraft sedan juni 2025 för ett brett spann av konsumentriktade tjänster, och eftersom det är måttstocken domstolar griper till under brittiska Equality Act och i amerikansk ADA-praxis. Är din podd en del av en omfattad tjänst är transkriptionen inte en artighet; den är golvet för efterlevnad. (Hela den juridiska bilden finns i vår kompletta guide till undertexter och transkriptioner enligt tillgänglighetsdirektivet.)

Och två publikgrupper har nytta av den långt innan någon tillsynsmyndighet tittar:

  • Människor som inte kan höra avsnittet — hela poängen med kriteriet — plus alla som läser i sammanhang där ljud inte fungerar.
  • Maskiner. Sökmotorer kan inte indexera ljud. En publicerad transkription är skillnaden mellan ett avsnitt som finns på det öppna nätet och ett som bara finns inuti poddappar. Varje citerbar mening blir sökbar, länkbar text.

De fem kraven

En poddtranskription når tillgänglighetsnivån när den gör fem saker:

  1. Den förmedlar samma innehåll som ljudet. Allt talat material — inte en sammanfattning, inte höjdpunkter. Lyssnaren med transkriptionen ska gå därifrån med det lyssnaren med hörlurar fick.
  2. Den visar tydligt vem som säger vad. Samtalet återges som märkt dialog — talarnamn, sedan orden. En omärkt vägg av text innehåller tekniskt sett innehållet och begraver det i praktiken.
  3. Den innehåller information utöver tal som spelar roll för förståelsen. [skratt] efter en torr replik, [applåder], [telefonen ringer] innan någon svarar, den [spända musiken] som sätter ett uttalande i ny dager. Testet är narrativ relevans: ta med de ljud ljudpubliken använde, hoppa över resten av bakgrunden.
  4. Den är skriven och kodad som text. Riktig, maskinläsbar text — markerbar, sökbar, vänlig mot skärmläsare. En skannad bild av en transkription, eller text inbakad i en grafik, faller på detta oavsett hur fullständiga orden är.
  5. Den går att hitta från avsnittet. Visuellt nära spelaren, eller nåbar via en uppenbar länk eller knapp. En perfekt transkription på en föräldralös sida ingen lyssnare hittar räknas inte som tillhandahållen.

Mallen

Så här ser de fem kraven ut på sidan. Kopiera formen, inte orden:

Avsnitt 42 — Behöver en podd egentligen en transkription? Inspelat 3 juni 2026 · 47 min Fullständig transkription nedan.
[Intromusik]
MARIA: Välkomna tillbaka till programmet. Jag heter Maria Lund, och i dag ska vi in i en fråga vi får hela tiden: vad tillgänglighetsreglerna faktiskt betyder för poddare.
JONAS: Tack för att jag fick komma. Det är ett större ämne än folk tror.
MARIA: Vi tar den brutala versionen först. Behöver en podd egentligen en transkription?
JONAS: [skrattar] Juridiskt? Om podden är del av en omfattad tjänst — ja. Men ärligt talat är det juridiska svaret det minst intressanta skälet att göra det.
MARIA: På grund av sök?
JONAS: På grund av sök. Ett avsnitt utan transkription är osynligt för Google. Med en blir varje mening du spelade in en sida någon kan landa på.
[Reklampaus]
MARIA: Före pausen nämnde du talarmärkning …

Lägg märke till vad formatet gör: namn i en konsekvent stil före varje replik, nytt stycke per replik, ljudmarkeringar i hakparentes exakt där de förekommer, och avsnittets struktur ([Intromusik], [Reklampaus]) utmärkt så att en läsare kan navigera på samma sätt som en lyssnare.

Tidsstämplar är valfria. De ingår inte i kravet, men att lägga in dem vid avsnittsbrytningar — eller per replik, om ditt verktyg genererar dem ändå — hjälper läsare att hoppa mellan text och ljud, och hjälper dig när någon frågar ”var sa han det där?”.

Var du ska publicera den — och RSS-tricket

Kravet säger går att hitta; erfarenheten säger att det finns fyra bra mönster, och att ett av dem är undervärderat:

På avsnittssidan, som expanderbar text. En ”Transkription”-rubrik eller en växlare direkt under spelaren. Det bästa allroundvalet: det uppfyller krav 5 vid en blick, och det är versionen sökmotorerna indexerar — HTML-text på din egen sida är hela SEO-vinsten realiserad.

En knapp i eller bredvid spelaren. Vissa hostingplattformar stöder en transkriptionskontroll i själva inbäddningen. Utmärkt närhet; se bara till att texten även finns som en indexerbar sida, inte enbart inuti en widget.

Ett transkriptionsarkiv. En egen sida som samlar nedladdningsbara versioner — helt okej som komplement, och användbart för läsare som vill ha kopior offline (PDF och DOCX är legitima här, så länge de är riktig text och inte skanningar). Svagt som enda hem, eftersom det skiljer transkriptionen från avsnittet.

RSS-tricket — gör det här oavsett vad du väljer i övrigt: lägg transkriptionslänken i avsnittsbeskrivningen i ditt RSS-flöde. Beskrivningen sprids till varje app som bär ditt program — Apple Podcasts, Spotify och resten — så länken dyker upp bredvid avsnittet överallt där det spelas, inklusive på de plattformar där du inte styr något annat på sidan. En rad i flödet, distribution till alla spelare på en gång.

Vad sägs om att bara publicera en sammanfattning?

Frestande, och det förtjänar ett ärligt svar: en sammanfattning ensam når inte nivån. WCAG 1.2.1 ber om ett textalternativ som förmedlar likvärdig information — och ett stycke om ett 47 minuter långt samtal är inte likvärdigt med samtalet.

Där sammanfattningar glänser är ovanpå transkriptionen: en inledning, en punktlista över ämnen, de viktigaste slutsatserna. Den kombinationen betjänar dem som skummar, hjälper sökmotorerna att förstå sidan och ger dem som delar i sociala medier något citerbart — medan den fullständiga transkriptionen därunder gör efterlevnadsjobbet. Sammanfattningen som dörren, transkriptionen som rummet.

(Huruvida själva transkriptionen bör vara strikt ordagrann eller lätt rensad från utfyllnadsord är en verklig bedömningsfråga med en verklig avvägning — vi har lagt fram båda sidorna i vår guide om undertextkvalitet.)

Gör en utan att förlora en eftermiddag

Att transkribera en timmes samtal manuellt tar de flesta fyra till sex timmar. Arbetsflödet i Inwista:

  1. Ladda upp avsnittet — ljud eller video, alla vanliga format.
  2. Automatisk transkription med talaridentifiering. Inwista skiljer på vem som talar och delar upp samtalet i repliker; i editorn ersätter du ”Speaker 1” och ”Speaker 2” med namn en gång, och märkningen gäller genom hela filen.
  3. Gå igenom i editorn — rätta ett namn här och där, lägg till de ljudmarkeringar ljudet behöver.
  4. Exportera som TXT, DOCX eller PDF — eller kopiera texten rakt in på din avsnittssida som HTML.

Resultatet är mallen ovan, genererad i stället för nedskriven.

Med Inwistas gratisplan kan du köra hela arbetsflödet på ditt eget material — ladda upp, transkribera, strukturera, redigera och exportera. Aktuella gränser och plandetaljer hittar du på prissidan.

Transkribera ditt nästa avsnitt gratis →

Vanliga frågor

Är en transkription lagstadgad för min podd? Är podden del av en tjänst som omfattas av tillgänglighetsdirektivet — eller faller du under motsvarande skyldigheter som brittiska Equality Act — är ett textalternativ för förinspelat ljud en del av den WCAG 2.1-nivå de regelverken pekar på. Utanför varje juridiskt tillämpningsområde är det fortfarande den enskilda åtgärd som ger mest tillgänglighet och SEO per krona en podd kan vidta.

Spotify och Apple genererar transkriptioner automatiskt nu. Täcker inte det mig? Det hjälper lyssnare inuti de apparna, men det är en vacklande position för efterlevnad: transkriptionerna lever bara på respektive plattform, i en kvalitet du inte styr över, och på din webbplats inte alls. Din skyldighet hänger på din tjänst — en transkription du publicerar är versionen som räknas, och den enda sökmotorerna någonsin får se.

Behöver jag tidsstämplar? Nej — de ingår inte i kravet. De är användbara för navigering och citering, så om ditt verktyg skapar dem ändå är det snarare en fin detalj än stökigt att behålla dem vid avsnittsbrytningar.

Räknas en PDF-transkription? Ja, om den är genuin text (markerbar, läsbar för skärmläsare) och tydligt länkad från avsnittet. En skannad bild i en PDF gör det inte. För söksynlighet slår HTML på avsnittssidan varje nedladdningsformat.

Bör transkriptionen vara ord för ord eller städad? Båda går att försvara. Ordagrant bevarar exakt det lyssnarna hörde och föredras av många döva och hörselskadade läsare; lätt rensning av utfyllnadsord läses bekvämare. Vad du än väljer: ändra aldrig innebörden — och var konsekvent mellan avsnitt.

Vilka ljud utöver tal ska jag ta med? De som bär betydelse: skratt, applåder, en telefon som ringer och besvaras, musik som sätter en scen. Hoppa över atmosfär som ljudpubliken inte medvetet använde. Är du osäker, fråga vad en läsare går miste om utan den.


Den här artikeln är allmän vägledning om tillgänglighetskrav för poddtranskriptioner, inte juridisk rådgivning. Skyldigheterna varierar med jurisdiktion och med om din tjänst omfattas av det aktuella regelverket — rådgör med kvalificerat juridiskt ombud om din situation.