Če ste kdaj odprli YouTube Studio in iskali gumb za samodejne podnapise, ste najbrž ugotovili, da ga za slovenske posnetke ni. To ni napaka v nastavitvah in ni nekaj, kar bi odklenili s preklopom jezika kanala. YouTubovi samodejni podnapisi pokrivajo omejen seznam jezikov in slovenščine na njem ni.
Posledica je preprosta in neprijetna: slovenski posnetek pride na platformo brez ene same vrstice besedila. Brez podnapisov, brez transkripta, brez ničesar, kar bi iskalnik ali gluh gledalec lahko prebral.
Kaj YouTube dejansko ponuja za slovenščino
Tri stvari je treba ločiti, ker se v pogovoru pogosto zlijejo v eno.
- Samodejni podnapisi (auto-captions): YouTube posluša zvok in napiše besedilo. Za slovenščino tega ne počne.
- Samodejni prevod (auto-translate): YouTube vzame obstoječi caption track in ga prevede v drug jezik. Brez izvornega tracka nima česa prevajati.
- Ročno naložen caption track: datoteka SRT ali VTT, ki jo naložite sami. To je edina pot, ki za slovenščino danes zanesljivo dela.
Druga točka je tista, ki ljudi najbolj preseneti. Auto-translate zveni kot rešitev, dokler ne ugotovite, da je odvisen od prve točke. Če samodejnih podnapisov ni, prevod nima vhoda. Veriga se pretrga na začetku.
Zakaj je to večji problem, kot se zdi
Brez caption tracka izgubite več kot dostopnost.
- Iskanje znotraj YouTuba: platforma indeksira besedilo podnapisov. Brez njih se vaša epizoda ne pojavi pri iskanju izraza, ki ste ga v njej izgovorili desetkrat.
- Gledanje brez zvoka: velik del ogledov na mobilnih napravah se začne z izklopljenim zvokom. Brez besedila na zaslonu gledalec ne ve, ali ga vsebina zanima.
- Tuje občinstvo: slovenščina ima majhen domači trg. Angleški prevod je za marsikateri kanal edina pot navzven, prevod pa se začne pri slovenskem transkriptu.
Tri poti do slovenskih podnapisov
Ročno. Odprete YouTube Studio, kliknete Subtitles in tipkate. Za desetminutni posnetek je to približno ura dela, za enourno epizodo štiri do šest ur. Natančnost je odlična, cena pa je vaš čas.
Generični ASR plus ročno nalaganje. Posnetek spustite skozi orodje za prepoznavo govora, dobite SRT, ga popravite in naložite. Hitrejše od ročnega pisanja, a še vedno ročen korak pri vsaki epizodi. Lastna imena, kratice in strokovni izrazi so tam, kjer se izgubi največ časa.
Avtomatiziran cevovod. Kanal povežete enkrat, vsak nov posnetek gre skozi prepoznavo in se caption track objavi sam. Ročnega koraka pri epizodi ni. To je pot, ki jo gradi Titlomat.
Katera je prava, je odvisno od ritma objavljanja. Pri enem posnetku na mesec je ročno delo znosno. Pri tedenski epizodi se nabere nekaj ur na mesec, ki jih ne porabite za vsebino.
Kaj smo izmerili o dolžini vrstice
Tu je podatek, ki ga skoraj nihče ne omenja, ko govori o samodejnih podnapisih.
Na našem benchmark naboru (trije posnetki, meritev 2026-05-10, stories/PHASE-0-BASELINE.md) je povprečna vrstica podnapisa merila 43 do 44 znakov. Delež vrstic, daljših od 42 znakov, je bil med 68 in 76 odstotki. Med 6 in 10 odstotki vrstic je na zaslonu ostalo manj kot sekundo.
Pomembna opomba: ta nabor je hrvaški, ne slovenski. Slovenskega benchmarka javno še nimamo, zato številk ne prenašamo na slovenščino kot da bi bile izmerjene tam. Prenašamo pa obliko problema, ker izvira iz načina, kako modeli segmentirajo govor, in ne iz posameznega jezika.
Zakaj je to sploh pomembno: 42 znakov na vrstico je uveljavljena meja berljivosti v podnaslavljanju. Vrstica, ki jo preseže, se na mobilnem zaslonu prelomi ali odreže. Vrstica, ki traja manj kot sekundo, je fizično neberljiva. Surov izhod iz modela je torej tehnično pravilen in hkrati neprijeten za branje. Segmentacija je ločen problem od natančnosti in se rešuje posebej.
Slovar ni čarobna palica
Ko lastna imena padejo, je prva ideja vedno ista: naredimo slovar in vsilimo pravilne zapise.
Deluje, a ne brezpogojno. V istem Phase 0 delu smo izmerili, da naivno sestavljen slovar zna WER tudi poslabšati. Če je vnos prekratek ali preveč generičen, se sproži tam, kjer ne bi smel, in popravi besede, ki so bile pravilne. Slovar z nekaj natančnimi vnosi je boljši od slovarja s stotimi ohlapnimi.
Praktično pravilo: v slovar sodijo imena gostov, blagovne znamke in strokovni izrazi, ki se v vaših epizodah ponavljajo. Ne sodijo vanj pogoste besede in ne sodijo kratki nizi, ki se skrivajo znotraj drugih besed.
Kje začeti
Če objavljate redno, je najcenejši prvi korak preizkus na enem svojem posnetku. Ne na demo datoteki, ampak na epizodi z vašim zvokom, vašimi gosti in vašim besediščem. Šele tam se vidi, kje model pada in kaj bo treba dati v slovar.
Titlomat lahko preizkusite brezplačno, brez kartice. Kaj koliko stane, piše na ceniku.
Če imate vprašanje o slovenščini, ki tu ni odgovorjeno, pišite na info@lumiverse.hr. Odgovarjamo isti dan.


