Etusivu › Äänitiedosto tekstiksi
Litterointi · Tiedostosta tekstiksi
Äänitiedosto tekstiksi Macilla
Sinulla on jo tiedosto — haastattelun nauhoitus, palaverin tallenne, luentovideo — ja tarvitset siitä tekstin. Raahaat tiedoston sovellukseen ja saat aikaleimatun, puhujittain jaetun litteroinnin. Tiedosto ei lähde Macilta minnekään: käsittely tehdään omalla koneella, ei palvelimella.
Tiedostosta tekstiksi kolmessa vaiheessa
- 1. Raahaa tiedosto sovellukseen. Äänitiedosto, videotiedosto tai sovelluksen oma nauhoitus — sama polku kaikille. Latausta odottavaa jonoa ei ole, koska mitään ei ladata mihinkään.
- 2. Tunnistus ajetaan koneellasi. Paikallinen puheentunnistusmalli muuttaa äänen tekstiksi Macin grafiikkasuorittimella. Kieli tunnistetaan automaattisesti, ja kieliä on 99. Samalla tallenne jaetaan puhujajaksoihin.
- 3. Tarkista ja vie eteenpäin. Teksti näkyy aikaleimoineen ja puhujajaksoineen. Voit nimetä puhujat, korjata kohtia, hakea tekstistä ja viedä tuloksen tiedostoon.
Arkikielessä tästä työstä puhutaan nauhojen purkamisena — moni etsii nimenomaan sitä, miten haastattelun saa purettua tekstiksi ilman että istuu tallenteen ääressä kirjoittamassa. Lopputulos on sama: kirjoitustyö vaihtuu lukemis- ja korjaustyöksi.
Mitkä tiedostot kelpaavat
Sovellus käyttää macOS:n omia mediakirjastoja, joten se käsittelee samat yleiset muodot, jotka QuickTime osaa toistaa: sanelimen MP3:t, puhelimen M4A-ääniviestit, WAV-tallenteet sekä MP4- ja MOV-videot. Nyrkkisääntö on yksinkertainen: jos tiedosto soi Macilla, sen ääniraita yleensä myös litteroituu.
| Lähde | Esimerkkejä | Mitä saat |
|---|---|---|
| Äänitiedosto | MP3, M4A, WAV, AIFF | Aikaleimattu teksti puhujajaksoineen |
| Videotiedosto | MP4, MOV | Sama teksti sekä tekstitykset SRT- tai VTT-muodossa |
| Sovelluksen oma nauhoitus | Palaveri, haastattelu, Macin kautta soitettu puhelu | Litterointi suoraan kirjastoon |
Lopputuloksen laadun kannalta tiedostomuoto merkitsee vähemmän kuin nauhoitustilanne. Takintaskussa nauhoitettu palaveri pysyy vaikeana pakkausmuodosta riippumatta.
Vienti: teksti vai tekstitykset
Valmiin litteroinnin saa ulos useassa muodossa sen mukaan, mihin sitä tarvitaan.
| Muoto | Sisältää | Tyypillinen käyttö |
|---|---|---|
| TXT | Leipätekstin puhujajaksoineen | Jatkotyöstö Wordissa tai Pagesissa, muistion pohja, analyysiohjelma |
| SRT | Aikaleimat ja tekstin lohkoina | Tekstitykset videoon, videoeditoriin tuonti |
| VTT | Aikaleimat ja tekstin verkkokäyttöön | Tekstitykset verkkosivun videosoittimeen |
Tekstitykset videoon
Tekstityksiä haetaan tyypillisesti kolmeen tarpeeseen: luentotallenteeseen, verkkosivulla julkaistavaan esittelyvideoon ja koulutusmateriaaliin. Työnkulku on sama kuin muutoinkin — video sisään, SRT tai VTT ulos — ja tiedosto pysyy koko ajan omalla koneella, mikä on merkityksellistä silloin, kun videota ei ole vielä julkaistu.
Rehellinen rajaus: tämä ei ole videoeditori eikä tekstitysten ajoituksen hienosäätötyökalu. Saat aikaleimatut tekstityslohkot, mutta rivijaon viilaaminen ja ajoituksen näpertely tehdään siinä ohjelmassa, jolla video muutenkin viimeistellään.
Julkishallinnon ja monen muun organisaation verkkopalveluita koskee digipalvelulaki (306/2019), ja tekstitykset liittyvät siihen keskusteluun. Mainitsemme tämän taustatietona: emme väitä, että sovelluksen tuottama tekstitys sellaisenaan täyttäisi mitään vaatimusta, ja sen arviointi kuuluu omalle organisaatiollesi.
Tiedosto ei lähde koneelta
Litterointi tehdään kokonaan Macilla: äänitiedostoa ei ladata palveluntarjoajan palvelimelle, käyttäjätiliä ei ole eikä litteroinnista veloiteta minuuteittain (ilmaisversion määrälliset rajat kerrotaan alempana). Sama työnkulku toimii lentokonetilassa ja verkossa, joka estää ulkoiset pilvipalvelut. Tämä on yleensä ratkaiseva ero silloin, kun tallenteella on luottamuksellista aineistoa — aihe on avattu kunnolla sivulla litterointi ilman pilveä.
Jos tallenteella on muita ihmisiä, muista lupa. Suomessa sellaisen keskustelun nauhoittaminen, johon itse osallistut, ei lähtökohtaisesti ole rikoslain 24:5:n salakuuntelua, mutta tallenteen ja siitä tehdyn litteroinnin jakaminen voi silti olla rangaistavaa (RL 24:8), ja aineisto on henkilötietoa. Työpaikalla nauhoittamisen käyttöönotossa on lisäksi omat sääntönsä. Tämä on yleistä tietoa, ei oikeudellinen neuvo.
Kuka sanoi mitä
Tallenne jaetaan automaattisesti puhujiin, ja puhujille voi antaa nimet. Haastattelussa tämä on koko työn ydin: ilman puhujajakoa kahden ihmisen keskustelu on yksi pitkä tekstimassa, jota ei voi lainata. Kahden tai kolmen hengen tallenteessa erottelu onnistuu selvästi paremmin kuin kymmenen hengen palaverissa, jossa keskeytetään. Tarkemmin sivulla puhujien erottelu.
Korjaaminen ja hakeminen
Litterointi ei jää pelkäksi tekstitiedostoksi. Jaksot on sidottu aikaleimoihin, joten epäselvän kohdan voi tarkistaa kuuntelemalla juuri sen kohdan tallenteesta sen sijaan, että kelaisi sokkona. Puhujien nimet voi antaa jälkikäteen ja väärin menneen jaon voi korjata käsin.
Tekstistä voi myös hakea, ja se on pitkien tallenteiden kohdalla se ominaisuus, jota käytetään eniten: kun muistat, että jotain sanottiin loppupuolella, haku vie suoraan kohtaan. Käytännössä työ muuttuu kirjoittamisesta lukemiseksi ja tarkistamiseksi.
Tyypilliset tilanteet
Sama työnkulku palvelee hyvin erilaisia tarpeita, ja ne kaikki jakavat saman lähtökohdan: tallenne on jo olemassa ja siitä tarvitaan luettava teksti.
- Haastattelututkimus. Litteroitu aineisto on analyysin raaka-aine, ja moni suostumuslomake kieltää nimenomaisesti raakaäänitteen luovuttamisen kolmannelle osapuolelle — silloin pilvipalvelu ei ole vaihtoehto lainkaan.
- Toimittajan haastattelu. Sitaatin tarkistaminen käy aikaleiman avulla nopeasti, ja lähdeaineisto pysyy omalla koneella.
- Luentotallenne ja opiskelu. Tekstistä voi hakea, ja kohdan löytäminen aikaleimalla korvaa nauhan kelaamisen.
- Palaverin tallenne. Litteroinnista kirjoitetaan muistio; tähän on oma sivunsa, kokousmuistio nauhoituksesta.
- Podcast ja koulutusvideo. Tekstistä syntyy sekä tekstitykset että hakukoneelle luettava sisältö.
Pitkät tallenteet
Tunnin tai kahden mittaiset tiedostot ovat tavallisia, ja ne käsitellään samalla tavalla kuin lyhyetkin. Koska laskenta tehdään omalla koneella, käsittelyn kesto riippuu Macin mallista ja tallenteen pituudesta, eikä palvelimen kuormasta. Kahden tunnin haastattelu työllistää konetta tuntuvasti sen ajan, kun sitä litteroidaan, ja kannettava lämpenee — se on paikallisen käsittelyn rehellinen kääntöpuoli.
Yksi käytännön etu seuraa suoraan siitä, ettei tuloksesta makseta minuuteittain: jos ensimmäinen tulos ei miellytä esimerkiksi väärän kieliasetuksen takia, saman tallenteen voi litteroida uudelleen ilman lisäkustannusta. Uudelleenlitterointi ei myöskään kuluta ilmaisversion kiintiötä.
Mitä laadulta kannattaa odottaa
Koneellinen litterointi on raakaversio. Se hoitaa näppäilytyön, mutta korjauskierros kuuluu asiaan:
- Erisnimet ja termit. Yritysten, virastojen ja järjestelmien nimet sekä alan sanasto menevät säännöllisesti väärin.
- Nauhoitustilanne. Kaiuttimesta nauhoitettu puhelu ja meluisa kenttätallenne antavat selvästi heikomman tuloksen kuin lähellä puhujaa ollut mikrofoni.
- Päällekkäinen puhe. Kun kaksi puhuu yhtä aikaa, sekä sanat että puhujien kohdistus kärsivät.
- Suomen taivutus ja yhdyssanat. Sijamuoto voi mennä väärin ja yhdyssana erilleen; tämä on käsitelty sivulla toimiiko puheentunnistus suomeksi.
Emme julkaise tarkkuusprosenttia, koska meillä ei ole mittausta, joka yleistyisi rehellisesti sinun tallenteisiisi. Paras tapa selvittää asia on ajaa oma tyypillinen tallenne läpi ja katsoa tulos.
Ilmaisversion kiintiö, hinta ja vaatimukset
Sovelluksen lataus on ilmainen, ja ilmaisversiolla pääsee kokeilemaan koko työnkulun. Rajat on reilua kertoa etukäteen, koska juuri tällä sivulla ne osuvat suoraan siihen, mitä olet tekemässä:
- Yhteensä 5 äänitiedoston ja 5 videon litterointia. Nämä ovat kokonaismääriä, eivät päivittäisiä.
- Sanelua 5 minuuttia päivässä.
- Nauhoittaminen on rajatonta eikä kuluta kiintiötä.
- Jo litteroidun tallenteen litterointi uudelleen on ilmaista eikä kuluta kiintiötä.
Rajat poistuvat Pro-avauksella, joka on kertaosto 49,99 $ — ei tilausmaksua eikä minuuttihinnastoa (App Store näyttää summan euroina). Vaatimukset: macOS 13 (Ventura) tai uudempi ja Apple Silicon (M1 tai uudempi); Intel-Maceja ei tueta.
Lataus on ilmainen — ilmaisversiossa on rajat. Ei tilausmaksua. · Pro-avaus kertaostoksena 49,99 $ (App Store näyttää hinnan euroina) · macOS 13 tai uudempi
Usein kysyttyä
Miten muutan äänitiedoston tekstiksi Macilla?
Raahaat äänitiedoston sovellukseen, jolloin paikallinen puheentunnistusmalli litteroi sen omalla koneellasi. Tuloksena on aikaleimattu teksti puhujajaksoineen, jonka voi viedä TXT-muodossa tai tekstityksinä SRT- ja VTT-muodossa. Tiedostoa ei ladata palvelimelle missään vaiheessa.
Mitä tiedostomuotoja voi litteroida?
Sovellus käyttää macOS:n mediakirjastoja, joten se käsittelee yleiset muodot kuten MP3, M4A, WAV ja AIFF sekä videot MP4- ja MOV-muodossa. Nyrkkisääntö: jos tiedosto soi Macilla, sen ääniraita yleensä myös litteroituu.
Onko minuuttirajaa?
Minuuttihinnastoa ei ole, mutta ilmaisversiossa on määrälliset rajat: yhteensä 5 äänitiedoston ja 5 videon litterointi — nämä ovat kokonaismääriä, eivät päivittäisiä — sekä 5 minuuttia sanelua päivässä. Nauhoittaminen on rajatonta ja jo litteroidun tallenteen litterointi uudelleen on ilmaista. Rajat poistuvat kertaostolla 49,99 $, joka ei ole tilaus.
Saanko tekstitykset videoon?
Saat. Videotiedostosta syntyy sama teksti kuin äänestäkin, ja sen voi viedä tekstityksinä SRT- tai VTT-muodossa. Tämä ei kuitenkaan ole videoeditori: rivijaon ja ajoituksen hienosäätö tehdään siinä ohjelmassa, jolla video viimeistellään.
Näkyykö litteroinnista, kuka puhui?
Näkyy. Tallenne jaetaan automaattisesti puhujajaksoihin ja puhujille voi antaa nimet. Kahden tai kolmen hengen haastattelussa erottelu onnistuu selvästi paremmin kuin isossa palaverissa, jossa puhutaan päällekkäin, ja jaon voi korjata käsin.
Kuinka hyvä lopputulos on suomeksi?
Koneellinen litterointi on raakaversio, joka luetaan läpi. Suomessa tyypillisimmät korjattavat kohdat ovat sijamuodot, erilleen kirjoittuneet yhdyssanat sekä erisnimet ja lyhenteet. Emme julkaise tarkkuusprosenttia, koska meillä ei ole mittausta, joka yleistyisi rehellisesti kaikkiin tallenteisiin.