Hyppää pääsisältöön
Haku

Subtitle Edit -sovelluksen ohjeet

Subtitle Edit on tekstitysohjelma, jolla voi luoda, muokata ja ajastaa tekstityksiä videoihin sekä litteroida audiota tai videota. Subtitle Edit -ohjelmassa erityisen hyviä ominaisuuksia ovat tarkat säätömahdollisuudet siihen, kuinka paljon ja kuinka kauan tekstiä näkyy ruudulla kerrallaan.

Ohjelmalla voi luoda tekstityksiä ja litteraatteja automaattisella puheentunnistuksella. Ohjelma sopii myös tiedonluokittelultaan salaisen (1R) tai luottamuksellinen rajoitettu (2A) aineiston eli myös erityisten henkilötietojen litterointiin, koska se toimii vain paikallisella tietokoneella, eikä lähetä mitään verkkoon. 

Subtitle Edit -sovelluksen asentaminen

Tekstitys manuaalisesti

Tekstitys tai litterointi puheentunnistuksella

Valmistautuminen

Henkilötietojen käsittely

  • Jos käsittelet henkilötietoja, sinun pitää aina tehdä käsittelystä tietosuojan riskien arviointi, katso ohjeet siihen sivuilta Tutkimuksen tietosuoja – yleisohje ja Tietosuojan vaikutustenarviointi.
  • Jos käsittelet erityisiin henkilötietoryhmiin kuuluvia tietoja  (EU:n yleisen tietosuoja-asetuksen artikla 9) tai muita tietoluokan 2A tai 1R tiedostoja (katso ohjeet sivulta Tiedonluokittelu ja tietoluokat):
    • Käsittelystä pitää tehdä perusteellinen tietosuojan vaikutustenarviointi DPIA, katso ohjeet siihen sivulta Tietosuojan vaikutustenarviointi.
    • ⁠Jos opiskelijan pitää käsitellä erityisiin henkilötietoryhmiin kuuluvia tietoja, tiedekunnan pitää tehdä opiskelijalle laaja resurssisopimus ja pyytää IT Helpdeskin kautta hänelle käyttöön samanlainen keskitetysti ylläpidetty tietokone kuin henkilökunnallakin.
    • Aineistoa saa käsitellä vain tietohallinnon keskitetysti ylläpitämällä tietokoneella, ei koskaan omalla kotitietokoneella.
    • Aineisto ja litteraatti pitää tallentaa erillisellä ohjelmalla salattuna. Katso ohjeet sivulta Tutkimusdatan hallinta ja tallennus.
  • Puheentunnistus OpenAI Whisper -pohjaisilla algoritmeilla toimii kaikilla Windows-tietokoneilla. Se toimii kuitenkin huomattavasti nopeammin, jos koneessa on Nvidian näytönohjain, jossa on riittävästi muistia.

Puheentunnistus

  • Avaa tekstitettävä video- tai äänitallenne valitsemalla valikossa Video→Open video.
  • Lataa ensimmäisellä ajokerralla ohjelman ehdottama lisäosa mpv klikkaamalla nappia Download and use ”mpv” as video player.
  • Valitse valikossa Video→Speech to text.
  • Lataa ensimmäisellä ajokerralla ohjelman mahdollisesti ehdottamat lisäosat, kuten FFmpeg ja Purfviews Faster-Whisper.
  • Voit testata puheentunnistuksen nopeutta ja laatua eri valinnoilla kohdissa Engine (puheentunnistusohjelma) ja Model (kielimalli). 
  • Engine-kohtaan hyvä lähtökohta on Purfview Faster Whisper XXL tai sen myöhempi versio
    • Voit valita käyttöön jonkin toisen enginen, mutta se voi olla tuntematon ohjelma tietoturvamekanismille AppLocker, jolloin AppLocker estää ohjelman suorittamisen ja saat siitä ilmoituksen. Jos niin käy, lähetä it-helpdesk [at] tuni.fi (IT Helpdeskiin) sähköposti, jossa kerrot tietokoneesi nimen ja että käytit Subtitle Edit -ohjelmassa engineä, josta sait AppLocker-ilmoituksen, ja pyydät viestissä, että AppLocker sallii tuon enginen ajamisen. Voit ottaa AppLockerin ilmoituksesta näyttökuvan tai kirjoittaa muuten talteen ilmoituksessa mainittu ohjelma, mutta se tieto löytyy kyllä AppLockerin logeistakin.
  • Valitse tallenteessa puhuttu kieli kohdassa Input language.
  • Valitse Model-kohdassa kielimalli, jolla haluat tehdä puheentunnistuksen.
    • Mallit, joiden nimen lopussa ei lue ”.en”, ovat monikielisiä.
    • Mitä isompi kielimalli, sitä paremmin se tunnistaa puhetta, mutta sitä hitaampi se on. Large-v3 tunnistaa ilmeisesti parhaiten ja large-v3-turbo on nopeampi. Suurella kielimallilla puheentunnistus voi kestää perus-TUNI-tietokoneella 2-3 kertaa tallenteen kestoajan. Medium-mallilla tunnistus kestää noin puolet siitä, mitä Large-malleilla. Kokeile, mikä malli sopii parhaiten tarpeisiisi.
    • Katso lisätietoa malleista Whisper-projektin sivulta.
  • Valitse Transcribe käynnistääksesi tallenteen käsittelyn.
  • Ohjelma lataa käytettävän puheentunnistusohjelman ja kielimallin ensimmäisellä ajokerralla. Suurimmat ovat kooltaan useita gigatavuja ja niiden lataaminen ja käyttöönotto voi kestää kauan.
  • Lataa myös ensimmäisellä ajokerralla ohjelman mahdollisesti ehdottamat lisäosat, kuten Cublas ja cuDNN libs.
  • Puheentunnistus voi epäonnistua, jos tietokoneessa on erillinen näytönohjain, jossa on liian vähän muistia (Large-mallit tarvitsevat 8 GB). Määrittele tällöin Advanced settings -kohdasta lisäasetuksiin "-d cpu" jolloin puheentunnistus tehdään tietokoneen prosessorilla. Tuo asetus voi olla hyvä myös tietokoneessa, jossa ei ole erillistä näytönohjainta, koska se voi nopeuttaa tunnistusta.
  • Voit laittaa useita tallenteita käsiteltäväksi peräkkäin Batch mode -toiminnolla.
  • Kun tekstitys on tuotettu puheentunnistuksella, voit tehdä editorissa korjauksia tekstityksen SRT-tiedostoon.
  • Tallenna teksti valitsemalla File-valikosta Export→Plain text. Samalla voit valita tekstin muotoilua, kuten aikakoodit ja rivitys.
  • Katso lisäohjeita Subtitle Edit -ohjelman käyttöön kehittäjän sivulta.

Videotallenteiden tekstitykset tutkimuskäytössä

Subtitle editilla tuotettuja SRT-tekstitystiedostoja voi analysoida esimerkiksi MAXQDA-ohjelmalla, jolla voit lisätä tekstityksiin ja litteraatteihin koodeja ja merkintöjä. Lisätietoja MAXQDA:sta.

 

IT Helpdesk
0294 520 500
it-helpdesk [at] tuni.fi (it-helpdesk[at]tuni[dot]fi)
helpdesk.tuni.fi
 

Julkaistu: 22.9.2022
Päivitetty: 11.8.2026