Etusivu › Puhujien erottelu

Litterointi · Puhujien erottelu

Puhujien erottelu: kuka sanoi mitä

Ilman puhujien erottelua monen ihmisen keskustelu on yksi pitkä tekstimassa, josta ei voi lainata mitään. Lesskeys jakaa tallenteen automaattisesti puhujiin, joille annat nimet — ja ääniprofiilit pysyvät Macissasi, koska mitään ei lähetetä palvelimelle.

100%omalla Macilla — ääntä ei ladata mihinkään
Ilmainenlataus — Pro-avaus 49,99 $ kertamaksuna
99kieltä, tunnistetaan automaattisesti
macOS 13+Apple Silicon (M1 tai uudempi)

Mitä puhujien erottelu tekee

Puheentunnistus vastaa kysymykseen, mitä sanottiin. Puhujien erottelu vastaa kysymykseen, kuka sanoi mitä. Tekniikasta käytetään suomenkielisissä teksteissä myös nimitystä diarisaatio, mutta arjessa asiaa haetaan juuri sillä kysymyksellä: kuka puhuu missäkin kohtaa.

Käytännössä tallenne pilkotaan puhejaksoihin, jokaisesta jaksosta lasketaan äänen ominaispiirteitä kuvaava sormenjälki, ja samankaltaiset jaksot ryhmitellään samalle puhujalle. Tulokseksi tulee teksti, jossa on aikaleimat ja vaihtuvat puhujajaksot. Sen jälkeen puhujille annetaan nimet, ja teksti muuttuu keskusteluksi, jota voi lukea ja lainata.

Erottelu tehdään samalla kertaa litteroinnin kanssa, eikä se ole erillinen palvelu tai lisäosa. Se toimii sekä sovelluksen omissa nauhoituksissa että sisään raahatuissa ääni- ja videotiedostoissa.

Nimet ja pysyvät ääniprofiilit

Kun annat puhujalle nimen, sen voi tallentaa ääniprofiiliksi. Silloin sama henkilö tunnistetaan myös seuraavissa tallenteissa, eikä nimiä tarvitse antaa joka kerta uudelleen. Toistuvassa työssä — viikkopalaverissa, saman tiimin haastattelusarjassa, säännöllisissä asiakastapaamisissa — tämä on se ominaisuus, joka säästää eniten käsityötä.

Arkkitehtuuri on tässä syytä sanoa täsmällisesti: ääniprofiilit tallennetaan omalle koneellesi, ne voi poistaa yksitellen, eikä niitä lähetetä minnekään. Palveluntarjoajan puolella ei ole rekisteriä äänistä, koska palveluntarjoajan puolta ei ole.

Nimeämisen jälkeen tekstiä voi suodattaa ja hakea puhujan mukaan. Haastatteluaineistossa tämä tarkoittaa, että saa esiin kaiken, mitä yksi henkilö sanoi, ilman että käy koko tallennetta läpi.

Erottelu ja litterointi kulkevat samassa tekstissä, joten lopputulos on luettavissa kuin näytelmän käsikirjoitus: puhujan nimi, aikaleima ja se, mitä hän sanoi. Juuri tämä muoto tekee tallenteesta käyttökelpoisen — pelkkä sanavirta ilman puhujaa on harvoin sellaisenaan mihinkään kelpaava.

Ääniprofiili on asia, joka on arvioitava

Tämä on sivun tärkein kohta, ja se on reilua sanoa suoraan. Pysyvä ääniprofiili on käsittelyä, jota voidaan arvioida tietosuoja-asetuksen 9 artiklan mukaisena erityisiin henkilötietoryhmiin kuuluvana biometrisena tunnistetietona silloin, kun sen tarkoituksena on henkilön yksilöiminen. Kyse ei ole siitä, että profiili sijaitsee omalla koneella — sijainti ei muuta käsittelyn luonnetta.

Emme esitä tästä mitään yhteensopivuus- tai sertifiointiväitettä emmekä väitä, että paikallinen tallennus poistaisi kysymyksen. Nostamme sen esiin, jotta se ei tulisi yllätyksenä: arviointi — käsittelyn peruste, informointi, säilytysaika ja poisto sekä mahdollinen vaikutustenarviointi — kuuluu oman organisaatiosi tietosuojavastaavalle tai lakiasiaintoimelle. Valvova viranomainen on tietosuojavaltuutetun toimisto. Yksinkertaisin tapa välttää koko kysymys on olla tallentamatta pysyviä profiileja ja nimetä puhujat tallennekohtaisesti.

Lupa: mitä Suomessa saa nauhoittaa

Suomen tilanne poikkeaa siitä, mihin englannin- tai saksankielinen ohjeistus totuttaa, joten se kannattaa lukea eikä olettaa.

Tutkimuskäytössä pätevät lisäksi TENK:n ihmiseen kohdistuvan tutkimuksen eettiset periaatteet, tietoon perustuva suostumus ja aineistonhallintasuunnitelma; Tietoarkiston anonymisointiohjeet ovat käytännön apuna siinä, mitä aineistosta poistetaan ennen arkistointia. Tämä on yleistä tietoa, ei oikeudellinen neuvo.

Missä erottelu menee pieleen

Automaattinen erottelu ei ole virheetön, ja on parempi tietää etukäteen, milloin se pettää. Karkea sääntö: mitä vähemmän puhujia ja mitä parempi mikrofoni, sitä luotettavampi tulos.

TallenneMiten erottelu yleensä onnistuu
Kahden tai kolmen hengen haastattelu hiljaisessa huoneessaHyvin
Verkkopalaveri, jossa kukin puhuu vuorollaanKohtalaisesti
Ison ryhmän palaveri, jossa keskeytetään ja puhutaan päällekkäinHeikosti
Kaiuttimesta nauhoitettu puheluHeikosti
Meluisa tila tai kaikuva neuvotteluhuoneHeikosti

Yleisimmät virheet ovat nämä: samanaikainen puhe sekoittaa jaksot, hyvin samankaltaiset äänet yhdistyvät samaksi puhujaksi, lyhyet väliinhuudot — joo, aivan, niin — kohdistuvat väärälle henkilölle, ja huonolaatuinen puhelinääni latistaa juuri niitä äänen piirteitä, joihin erottelu perustuu. Virheet voi korjata käsin, ja korjaus kannattaa tehdä ennen kuin tekstiä käyttää mihinkään.

Miten tulosta parantaa

Erottelun laatuun vaikutetaan enemmän nauhoitushetkellä kuin jälkikäteen asetuksia säätämällä. Muutama asia auttaa selvästi:

Mihin tätä käytetään

Puhujien erottelusta on hyötyä aina, kun tallenteella on enemmän kuin yksi ihminen ja tekstiä on tarkoitus käyttää johonkin muuhun kuin muistin tueksi.

Vaatimukset ja hinta

Puhujien erottelu toimii samoilla vaatimuksilla kuin muukin: macOS 13 (Ventura) tai uudempi ja Apple Silicon (M1 tai uudempi); Intel-Maceja ei tueta. Kieliä tunnistetaan 99 automaattisesti.

Lataus on ilmainen. Ilmaisversiossa on rajat: sanelua 5 minuuttia päivässä sekä yhteensä 5 äänen ja 5 videon litterointia — kokonaismääriä, ei päivittäisiä. Nauhoittaminen on rajatonta, ja jo litteroidun tallenteen litterointi uudelleen on ilmaista. Rajat poistuvat kertaostolla 49,99 $, joka ei ole tilaus (App Store näyttää summan euroina).

Lataa Mac App Storesta

Lataus on ilmainen — ilmaisversiossa on rajat. Ei tilausmaksua. · Pro-avaus kertaostoksena 49,99 $ (App Store näyttää hinnan euroina) · macOS 13 tai uudempi

Usein kysyttyä

Mitä puhujien erottelu tarkoittaa?

Puhujien erottelu jakaa tallenteen automaattisesti puhujiin, jolloin litteroinnista näkee, kuka sanoi mitä ja missä kohtaa. Teknisissä teksteissä käytetään myös nimitystä diarisaatio. Puhujille voi antaa nimet, ja tekstiä voi hakea ja suodattaa puhujan mukaan.

Tunnistaako sovellus saman henkilön seuraavassa tallenteessa?

Tunnistaa, jos tallennat puhujasta pysyvän ääniprofiilin. Profiilit tallennetaan omalle koneellesi, ne voi poistaa yksitellen eikä niitä lähetetä minnekään. Ilman profiilia puhujat nimetään tallennekohtaisesti.

Onko ääniprofiili biometrista henkilötietoa?

Se voi olla. Pysyvää ääniprofiilia voidaan arvioida tietosuoja-asetuksen 9 artiklan mukaisena biometrisena tunnistetietona silloin, kun tarkoituksena on henkilön yksilöiminen, eikä paikallinen tallennus poista tätä kysymystä. Arviointi kuuluu organisaatiosi tietosuojavastaavalle — emme esitä yhteensopivuus- tai sertifiointiväitteitä.

Saako palaverin nauhoittaa ja jakaa litteroinnin muille?

Sellaisen keskustelun tallentaminen, johon itse osallistut, ei lähtökohtaisesti ole rikoslain 24:5:n salakuuntelua. Jakaminen on eri asia: levittäminen voi täyttää yksityiselämää loukkaavan tiedon levittämisen tunnusmerkistön (RL 24:8), ja aineisto on henkilötietoa. Työpaikalla sovelletaan lisäksi lakia yksityisyyden suojasta työelämässä (759/2004) ja yhteistoimintalakia (1333/2021). Tämä on yleistä tietoa, ei oikeudellinen neuvo.

Kuinka luotettavaa automaattinen erottelu on?

Kahden tai kolmen hengen haastattelu hiljaisessa huoneessa onnistuu selvästi paremmin kuin ison ryhmän palaveri. Erottelu pettää tyypillisesti päällekkäisessä puheessa, hyvin samankaltaisilla äänillä, lyhyissä väliinhuudoissa ja kaiuttimesta nauhoitetussa puhelussa. Virheet voi korjata käsin.

Montako puhujaa tallenteessa voi olla?

Puhujien määrää ei tarvitse tietää etukäteen, vaan jako tehdään automaattisesti. Käytännössä laatu heikkenee sitä mukaa kuin puhujia tulee lisää ja päällekkäistä puhetta on enemmän, joten haastattelu onnistuu paremmin kuin kymmenen hengen palaveri.

Aiheeseen liittyvää