Etusivu › Puhujien erottelu
Litterointi · Puhujien erottelu
Puhujien erottelu: kuka sanoi mitä
Ilman puhujien erottelua monen ihmisen keskustelu on yksi pitkä tekstimassa, josta ei voi lainata mitään. Lesskeys jakaa tallenteen automaattisesti puhujiin, joille annat nimet — ja ääniprofiilit pysyvät Macissasi, koska mitään ei lähetetä palvelimelle.
Mitä puhujien erottelu tekee
Puheentunnistus vastaa kysymykseen, mitä sanottiin. Puhujien erottelu vastaa kysymykseen, kuka sanoi mitä. Tekniikasta käytetään suomenkielisissä teksteissä myös nimitystä diarisaatio, mutta arjessa asiaa haetaan juuri sillä kysymyksellä: kuka puhuu missäkin kohtaa.
Käytännössä tallenne pilkotaan puhejaksoihin, jokaisesta jaksosta lasketaan äänen ominaispiirteitä kuvaava sormenjälki, ja samankaltaiset jaksot ryhmitellään samalle puhujalle. Tulokseksi tulee teksti, jossa on aikaleimat ja vaihtuvat puhujajaksot. Sen jälkeen puhujille annetaan nimet, ja teksti muuttuu keskusteluksi, jota voi lukea ja lainata.
Erottelu tehdään samalla kertaa litteroinnin kanssa, eikä se ole erillinen palvelu tai lisäosa. Se toimii sekä sovelluksen omissa nauhoituksissa että sisään raahatuissa ääni- ja videotiedostoissa.
Nimet ja pysyvät ääniprofiilit
Kun annat puhujalle nimen, sen voi tallentaa ääniprofiiliksi. Silloin sama henkilö tunnistetaan myös seuraavissa tallenteissa, eikä nimiä tarvitse antaa joka kerta uudelleen. Toistuvassa työssä — viikkopalaverissa, saman tiimin haastattelusarjassa, säännöllisissä asiakastapaamisissa — tämä on se ominaisuus, joka säästää eniten käsityötä.
Arkkitehtuuri on tässä syytä sanoa täsmällisesti: ääniprofiilit tallennetaan omalle koneellesi, ne voi poistaa yksitellen, eikä niitä lähetetä minnekään. Palveluntarjoajan puolella ei ole rekisteriä äänistä, koska palveluntarjoajan puolta ei ole.
Nimeämisen jälkeen tekstiä voi suodattaa ja hakea puhujan mukaan. Haastatteluaineistossa tämä tarkoittaa, että saa esiin kaiken, mitä yksi henkilö sanoi, ilman että käy koko tallennetta läpi.
Erottelu ja litterointi kulkevat samassa tekstissä, joten lopputulos on luettavissa kuin näytelmän käsikirjoitus: puhujan nimi, aikaleima ja se, mitä hän sanoi. Juuri tämä muoto tekee tallenteesta käyttökelpoisen — pelkkä sanavirta ilman puhujaa on harvoin sellaisenaan mihinkään kelpaava.
Ääniprofiili on asia, joka on arvioitava
Tämä on sivun tärkein kohta, ja se on reilua sanoa suoraan. Pysyvä ääniprofiili on käsittelyä, jota voidaan arvioida tietosuoja-asetuksen 9 artiklan mukaisena erityisiin henkilötietoryhmiin kuuluvana biometrisena tunnistetietona silloin, kun sen tarkoituksena on henkilön yksilöiminen. Kyse ei ole siitä, että profiili sijaitsee omalla koneella — sijainti ei muuta käsittelyn luonnetta.
Emme esitä tästä mitään yhteensopivuus- tai sertifiointiväitettä emmekä väitä, että paikallinen tallennus poistaisi kysymyksen. Nostamme sen esiin, jotta se ei tulisi yllätyksenä: arviointi — käsittelyn peruste, informointi, säilytysaika ja poisto sekä mahdollinen vaikutustenarviointi — kuuluu oman organisaatiosi tietosuojavastaavalle tai lakiasiaintoimelle. Valvova viranomainen on tietosuojavaltuutetun toimisto. Yksinkertaisin tapa välttää koko kysymys on olla tallentamatta pysyviä profiileja ja nimetä puhujat tallennekohtaisesti.
Lupa: mitä Suomessa saa nauhoittaa
Suomen tilanne poikkeaa siitä, mihin englannin- tai saksankielinen ohjeistus totuttaa, joten se kannattaa lukea eikä olettaa.
- Oma keskustelu. Sellaisen keskustelun tallentaminen, johon itse osallistut, ei lähtökohtaisesti ole rikoslain 24 luvun 5 §:n salakuuntelua, koska säännös koskee keskustelua, jota ei ole tarkoitettu tallentajan tietoon. Sen sijaan sellaisen yksityisen keskustelun salaa tallentaminen, johon et itse osallistu, on rangaistavaa.
- Sallittu tallentaa ei tarkoita sallittua levittää. Tallenteen tai siitä tehdyn litteroinnin jakaminen voi täyttää yksityiselämää loukkaavan tiedon levittämisen tunnusmerkistön (RL 24:8), ja aineisto on aina henkilötietoa (tietosuoja-asetus ja tietosuojalaki 1050/2018).
- Työpaikalla on omat sääntönsä. Laki yksityisyyden suojasta työelämässä (759/2004) asettaa tarpeellisuusvaatimuksen, josta ei voi poiketa edes työntekijän suostumuksella, ja teknisen valvonnan ja tiedonkeruun käyttöönotto kuuluu yhteistoimintalain (1333/2021) mukaiseen vuoropuheluun henkilöstön kanssa ennen käyttöönottoa.
- Kerro myös profiilista. Jos tallennat pysyvän ääniprofiilin, kerro siitä nauhoitettaville — pelkkä nauhoitusluvan pyytäminen ei kata sitä.
Tutkimuskäytössä pätevät lisäksi TENK:n ihmiseen kohdistuvan tutkimuksen eettiset periaatteet, tietoon perustuva suostumus ja aineistonhallintasuunnitelma; Tietoarkiston anonymisointiohjeet ovat käytännön apuna siinä, mitä aineistosta poistetaan ennen arkistointia. Tämä on yleistä tietoa, ei oikeudellinen neuvo.
Missä erottelu menee pieleen
Automaattinen erottelu ei ole virheetön, ja on parempi tietää etukäteen, milloin se pettää. Karkea sääntö: mitä vähemmän puhujia ja mitä parempi mikrofoni, sitä luotettavampi tulos.
| Tallenne | Miten erottelu yleensä onnistuu |
|---|---|
| Kahden tai kolmen hengen haastattelu hiljaisessa huoneessa | Hyvin |
| Verkkopalaveri, jossa kukin puhuu vuorollaan | Kohtalaisesti |
| Ison ryhmän palaveri, jossa keskeytetään ja puhutaan päällekkäin | Heikosti |
| Kaiuttimesta nauhoitettu puhelu | Heikosti |
| Meluisa tila tai kaikuva neuvotteluhuone | Heikosti |
Yleisimmät virheet ovat nämä: samanaikainen puhe sekoittaa jaksot, hyvin samankaltaiset äänet yhdistyvät samaksi puhujaksi, lyhyet väliinhuudot — joo, aivan, niin — kohdistuvat väärälle henkilölle, ja huonolaatuinen puhelinääni latistaa juuri niitä äänen piirteitä, joihin erottelu perustuu. Virheet voi korjata käsin, ja korjaus kannattaa tehdä ennen kuin tekstiä käyttää mihinkään.
Miten tulosta parantaa
Erottelun laatuun vaikutetaan enemmän nauhoitushetkellä kuin jälkikäteen asetuksia säätämällä. Muutama asia auttaa selvästi:
- Vie mikrofoni lähelle puhujia. Pöydän toisessa päässä oleva kone tallentaa enemmän huonetta kuin ääntä, ja juuri ne piirteet, joilla puhujat erotetaan, katoavat ensimmäisenä kaikuun.
- Vältä kaiutinpuhelinta. Puhelinlinjan kautta tuleva ääni on kapeakaistaista, ja kaiuttimen kautta nauhoitettuna siitä katoaa vielä lisää.
- Pyydä kierros nimiä alussa. Kun jokainen sanoo nimensä nauhan alussa, puhujien tunnistaminen jälkikäteen käy silmämääräisesti, vaikka automaattinen jako menisi osin sekaisin.
- Verkkopalaverissa käytä kuulokkeita. Kuulokkeet estävät sen, että toisten puhe vuotaa oman mikrofonin kautta takaisin nauhalle kahtena päällekkäisenä äänenä.
- Nimeä puhujat heti. Nimet on nopeinta antaa silloin, kun palaveri on vielä tuoreessa muistissa.
Mihin tätä käytetään
Puhujien erottelusta on hyötyä aina, kun tallenteella on enemmän kuin yksi ihminen ja tekstiä on tarkoitus käyttää johonkin muuhun kuin muistin tueksi.
- Haastattelututkimus. Puhujakohtainen teksti on analyysin edellytys, ja sitaatin voi jäljittää aikaleimalla takaisin tallenteeseen.
- Palaverit. Muistion kirjoittaja näkee, kenen ehdotus oli kenen ja kuka lupasi hoitaa mitäkin.
- Toimittajan haastattelu. Sitaatin tarkistus on nopeaa, kun teksti on jaettu puhujiin.
- Asiakastapaamiset. Kun samat henkilöt toistuvat, pysyvä profiili poistaa nimeämistyön.
- Koulutus ja perehdytys. Kysymys ja vastaus erottuvat toisistaan, jolloin tallenteesta saa jälkikäteen koostettua kysytyimmät kohdat.
Vaatimukset ja hinta
Puhujien erottelu toimii samoilla vaatimuksilla kuin muukin: macOS 13 (Ventura) tai uudempi ja Apple Silicon (M1 tai uudempi); Intel-Maceja ei tueta. Kieliä tunnistetaan 99 automaattisesti.
Lataus on ilmainen. Ilmaisversiossa on rajat: sanelua 5 minuuttia päivässä sekä yhteensä 5 äänen ja 5 videon litterointia — kokonaismääriä, ei päivittäisiä. Nauhoittaminen on rajatonta, ja jo litteroidun tallenteen litterointi uudelleen on ilmaista. Rajat poistuvat kertaostolla 49,99 $, joka ei ole tilaus (App Store näyttää summan euroina).
Lataus on ilmainen — ilmaisversiossa on rajat. Ei tilausmaksua. · Pro-avaus kertaostoksena 49,99 $ (App Store näyttää hinnan euroina) · macOS 13 tai uudempi
Usein kysyttyä
Mitä puhujien erottelu tarkoittaa?
Puhujien erottelu jakaa tallenteen automaattisesti puhujiin, jolloin litteroinnista näkee, kuka sanoi mitä ja missä kohtaa. Teknisissä teksteissä käytetään myös nimitystä diarisaatio. Puhujille voi antaa nimet, ja tekstiä voi hakea ja suodattaa puhujan mukaan.
Tunnistaako sovellus saman henkilön seuraavassa tallenteessa?
Tunnistaa, jos tallennat puhujasta pysyvän ääniprofiilin. Profiilit tallennetaan omalle koneellesi, ne voi poistaa yksitellen eikä niitä lähetetä minnekään. Ilman profiilia puhujat nimetään tallennekohtaisesti.
Onko ääniprofiili biometrista henkilötietoa?
Se voi olla. Pysyvää ääniprofiilia voidaan arvioida tietosuoja-asetuksen 9 artiklan mukaisena biometrisena tunnistetietona silloin, kun tarkoituksena on henkilön yksilöiminen, eikä paikallinen tallennus poista tätä kysymystä. Arviointi kuuluu organisaatiosi tietosuojavastaavalle — emme esitä yhteensopivuus- tai sertifiointiväitteitä.
Saako palaverin nauhoittaa ja jakaa litteroinnin muille?
Sellaisen keskustelun tallentaminen, johon itse osallistut, ei lähtökohtaisesti ole rikoslain 24:5:n salakuuntelua. Jakaminen on eri asia: levittäminen voi täyttää yksityiselämää loukkaavan tiedon levittämisen tunnusmerkistön (RL 24:8), ja aineisto on henkilötietoa. Työpaikalla sovelletaan lisäksi lakia yksityisyyden suojasta työelämässä (759/2004) ja yhteistoimintalakia (1333/2021). Tämä on yleistä tietoa, ei oikeudellinen neuvo.
Kuinka luotettavaa automaattinen erottelu on?
Kahden tai kolmen hengen haastattelu hiljaisessa huoneessa onnistuu selvästi paremmin kuin ison ryhmän palaveri. Erottelu pettää tyypillisesti päällekkäisessä puheessa, hyvin samankaltaisilla äänillä, lyhyissä väliinhuudoissa ja kaiuttimesta nauhoitetussa puhelussa. Virheet voi korjata käsin.
Montako puhujaa tallenteessa voi olla?
Puhujien määrää ei tarvitse tietää etukäteen, vaan jako tehdään automaattisesti. Käytännössä laatu heikkenee sitä mukaa kuin puhujia tulee lisää ja päällekkäistä puhetta on enemmän, joten haastattelu onnistuu paremmin kuin kymmenen hengen palaveri.