Startpagina › Wie zegt wat in een opname

Functie · Sprekerherkenning

Wie zegt wat: sprekers herkennen in een opname

Een transcript van een gesprek met vier mensen zonder namen erbij is bijna waardeloos: je leest een muur tekst en weet niet wie wat zei. Lesskeys splitst een opname automatisch per stem, laat je namen toekennen en herkent dezelfde mensen in volgende opnames — allemaal op je eigen Mac.

100%lokaal op je Mac — audio wordt nooit geüpload
Gratisdownloaden — Pro eenmalig $49,99, geen abonnement
99talen, automatisch herkend
macOS 13+Apple Silicon (M1 of nieuwer)

Sprekers scheiden — in vaktaal: diarisatie

De taak heet in de vakliteratuur sprekerdiarisatie en beantwoordt de vraag “wie spreekt wanneer”. Ze staat los van de spraakherkenning: de één bepaalt wat er gezegd is, de ander door wie. Pas samen leveren ze een leesbaar gespreksverslag op.

Technisch gaat dat in stappen. Eerst wordt bepaald waar er überhaupt gesproken wordt en waar stilte zit. Vervolgens wordt voor elk stukje spraak een getalsmatige vingerafdruk van de stem berekend — een reeks getallen die de klankkleur beschrijft. Die vingerafdrukken worden daarna gegroepeerd: fragmenten die op elkaar lijken horen waarschijnlijk bij dezelfde persoon. Tot slot worden opeenvolgende fragmenten van dezelfde stem samengevoegd, zodat er niet elke vijf seconden een nieuwe alinea begint.

Belangrijk om te begrijpen: de software herkent verschillen tussen stemmen, geen identiteiten. Wie “Spreker 1” is, weet alleen jij — daarom ken jij de namen toe.

Zo gaat het in de praktijk

Namen onthouden over meerdere opnames

Spreek je elke week met dezelfde mensen, dan is telkens opnieuw benoemen vervelend. De app kan daarom stemprofielen bewaren: de vingerafdruk van een benoemde stem blijft lokaal opgeslagen, zodat dezelfde persoon in de volgende opname automatisch met haar of zijn naam wordt voorgesteld. Bij een wekelijks overleg of een serie interviews scheelt dat merkbaar tijd.

Juist hier is een waarschuwing op zijn plaats. Een stemprofiel is een persoonsgegeven en is naar zijn aard bedoeld om iemand terug te herkennen. Behandel het daarnaar. Concreet betekent dat: vertel de betrokkenen dat je stemmen laat onthouden, bewaar geen profielen van mensen die dat niet willen, en wis een profiel als iemand daarom vraagt. Omdat alles lokaal staat, is er geen dienst die dat voor je regelt — verwijderen is jouw eigen handeling, in de app op je eigen Mac.

Wij claimen uitdrukkelijk geen bepaalde nauwkeurigheid van de toewijzing en geen geschiktheid om iemand mee te identificeren.

Hoe betrouwbaar is de toewijzing?

Bij netjes opgenomen gesprekken met twee tot vier mensen die elkaar laten uitpraten, is de scheiding in de regel goed bruikbaar. Lastiger wordt het hier:

SituatieResultaatWat helpt
Twee personen, headsets, duidelijke beurtwisselingZeer betrouwbaar
Vier tot zes mensen aan tafelBruikbaar, met correctiesMicrofoon dichter bij de groep
Door elkaar pratenFoutgevoeligFragment terugluisteren en handmatig toewijzen
Sterk gelijkende stemmenDeels door elkaar gehaaldBlokken met de hand splitsen
Korte tussenwerpsels (“hm”, “ja”)Vaak aan de verkeerde sprekerNegeren of corrigeren
Slechte telefoonlijnZwakAan beide kanten lokaal opnemen

Ook het aantal sprekers wordt geschat, niet gegarandeerd. Zit er iemand in de opname die maar twee zinnen zegt, dan is de kans reëel dat die bij een ander wordt ingedeeld. Weet je vooraf hoeveel mensen er meedoen, dan kun je dat aantal opgeven, wat de schatting meestal verbetert.

De opname bepaalt het resultaat

Sprekerscheiding werkt op klankverschillen, dus elke verbetering van de opname wint het van elke instelling. Drie dingen leveren in de praktijk het meeste op. Ten eerste afstand: hoe dichter de microfoon bij de sprekers, hoe scherper de stemafdruk. Ten tweede de ruimte — galm vervaagt precies de kenmerken die twee stemmen onderscheidbaar maken, dus een kale vergaderzaal met een glazen wand is het slechtst denkbare decor. Ten derde de gespreksleiding: een kort voorstelrondje aan het begin geeft elke stem een schoon, ononderbroken fragment om zich aan vast te houden — en maakt het benoemen achteraf een fluitje van een cent.

Waarom dit lokaal gebeurt

Sprekertoewijzing is juist nodig bij opnames die vertrouwelijk zijn: functioneringsgesprekken, intakes, interviews, cliëntgesprekken, onderzoeksdata. Precies dat materiaal aan een online dienst geven is bij veel organisaties het punt waar het plan sneuvelt.

Bij Lesskeys draaien de spraakherkenning én de sprekerscheiding op je eigen Mac. De opname wordt niet geüpload, er is geen account nodig en er is geen partij die het materiaal namens jou verwerkt. Dat is een beschrijving van de architectuur — geen uitspraak over de rechtmatigheid van jouw verwerking. Of je een bepaald gesprek mag opnemen, stemprofielen mag aanleggen en de uitkomsten mag bewaren, beoordeel je met je functionaris gegevensbescherming of privacyjurist; wij claimen geen AVG-conformiteit en geen certificering.

Toestemming en het opnemen van anderen

In Nederland is het opnemen van een gesprek waaraan je zelf deelneemt niet strafbaar: artikel 139a Sr gaat over het heimelijk opnemen van gesprekken waar je géén deelnemer aan bent. De strenge formuleringen op Duits- of Engelstalige pagina’s gelden hier dus niet zonder meer. “Niet strafbaar” is alleen niet “altijd toegestaan”: in werkverband val je buiten de huishoudelijke uitzondering van de AVG en heb je een grondslag nodig, heeft de ondernemingsraad een stem bij het monitoren van medewerkers, is de Autoriteit Persoonsgegevens de toezichthouder, en kan het delen of publiceren van een stiekeme opname alsnog onrechtmatig zijn.

In de praktijk werkt deze volgorde het beste:

Dit is een toelichting, geen juridisch advies. Meer over de vergadercontext staat bij notulen maken van een vergaderopname.

Systeemeisen en kosten

Vanaf macOS 13 (Ventura) op een Mac met Apple Silicon (M1 of nieuwer) — Apple Silicon is een eis, Intel-Macs worden niet ondersteund. Er worden 99 talen herkend, automatisch. Downloaden is gratis; de volledige versie schakel je vrij met een eenmalige in-app-aankoop van $49,99 (in de Nederlandse App Store in euro’s), geen abonnement. In de gratis versie zit 5 minuten dictaat per dag plus 5 audio- en 5 videotranscripties in totaal; opnemen en opnieuw laten uitwerken zijn onbeperkt.

Downloaden in de Mac App Store

Gratis te downloaden. Eenmalig betalen. Geen abonnement. · Pro eenmalig $49,99 (in de Nederlandse App Store in euro's) · macOS 13 of nieuwer

Veelgestelde vragen

Hoe zie ik in een transcript wie wat heeft gezegd?

De opname wordt automatisch per stem gescheiden, waarna het transcript uit blokken bestaat met een tijdcode en een sprekeraanduiding. Je benoemt één blok en alle blokken van dezelfde stem nemen die naam over. Verkeerde toewijzingen corrigeer je per blok.

Hoeveel sprekers kan de app onderscheiden?

Twee tot vier personen met duidelijke beurtwisselingen worden in de regel betrouwbaar gescheiden. Bij grotere groepen blijft het bruikbaar maar zijn correcties nodig. Het aantal sprekers wordt geschat, niet gegarandeerd; weet je het aantal vooraf, dan kun je dat opgeven.

Worden mijn opnames geüpload voor de sprekerscheiding?

Nee. Zowel de spraakherkenning als de sprekerscheiding draait op je eigen Mac. De opname verlaat het apparaat niet, er is geen account nodig en er is geen partij die het materiaal namens jou verwerkt.

Herkent de app dezelfde persoon in latere opnames?

Ja, als je stemprofielen bewaart. De vingerafdruk van een benoemde stem blijft lokaal opgeslagen en wordt in een volgende opname voorgesteld. Een stemprofiel is een persoonsgegeven, dus vertel de betrokkenen dat je het bewaart en wis het als daarom wordt gevraagd — dat doe je zelf, in de app.

Mag ik een gesprek met meerdere mensen opnemen?

In Nederland is het opnemen van een gesprek waaraan je zelf deelneemt niet strafbaar; artikel 139a Sr gaat over gesprekken waar je geen deelnemer aan bent. In werkverband heb je wel een grondslag onder de AVG nodig en heeft de ondernemingsraad een stem. Meld het aan het begin en noteer de instemming.

Kan ik op de sprekertoewijzing vertrouwen?

Het is een goede werkbasis, geen garantie. De software onderscheidt stemmen, ze identificeert geen personen, en wij claimen geen bepaalde nauwkeurigheid of geschiktheid voor identificatie. Belangrijke passages luister je terug voordat je ze gebruikt.

Meer hierover