Startpagina › Wie zegt wat in een opname
Functie · Sprekerherkenning
Wie zegt wat: sprekers herkennen in een opname
Een transcript van een gesprek met vier mensen zonder namen erbij is bijna waardeloos: je leest een muur tekst en weet niet wie wat zei. Lesskeys splitst een opname automatisch per stem, laat je namen toekennen en herkent dezelfde mensen in volgende opnames — allemaal op je eigen Mac.
Sprekers scheiden — in vaktaal: diarisatie
De taak heet in de vakliteratuur sprekerdiarisatie en beantwoordt de vraag “wie spreekt wanneer”. Ze staat los van de spraakherkenning: de één bepaalt wat er gezegd is, de ander door wie. Pas samen leveren ze een leesbaar gespreksverslag op.
Technisch gaat dat in stappen. Eerst wordt bepaald waar er überhaupt gesproken wordt en waar stilte zit. Vervolgens wordt voor elk stukje spraak een getalsmatige vingerafdruk van de stem berekend — een reeks getallen die de klankkleur beschrijft. Die vingerafdrukken worden daarna gegroepeerd: fragmenten die op elkaar lijken horen waarschijnlijk bij dezelfde persoon. Tot slot worden opeenvolgende fragmenten van dezelfde stem samengevoegd, zodat er niet elke vijf seconden een nieuwe alinea begint.
Belangrijk om te begrijpen: de software herkent verschillen tussen stemmen, geen identiteiten. Wie “Spreker 1” is, weet alleen jij — daarom ken jij de namen toe.
Zo gaat het in de praktijk
- Opnemen of een bestand laden. De app kan microfoon en systeemgeluid tegelijk opnemen, dus ook een videogesprek — zonder dat er een bot aan de vergadering wordt toegevoegd. Een bestaande opname sleep je er gewoon in.
- Automatisch scheiden. Na het uitwerken staat het transcript in blokken, elk met een tijdcode en een voorlopige sprekeraanduiding.
- Namen toekennen. Je benoemt één blok en alle blokken van dezelfde stem nemen die naam over.
- Corrigeren. Verkeerd toegewezen passages zet je handmatig bij de juiste spreker, en twee ten onrechte gesplitste stemmen voeg je samen.
- Zoeken en exporteren. Het transcript is doorzoekbaar, ook per spreker, en gaat er als tekstbestand of als ondertitelbestand weer uit.
Namen onthouden over meerdere opnames
Spreek je elke week met dezelfde mensen, dan is telkens opnieuw benoemen vervelend. De app kan daarom stemprofielen bewaren: de vingerafdruk van een benoemde stem blijft lokaal opgeslagen, zodat dezelfde persoon in de volgende opname automatisch met haar of zijn naam wordt voorgesteld. Bij een wekelijks overleg of een serie interviews scheelt dat merkbaar tijd.
Juist hier is een waarschuwing op zijn plaats. Een stemprofiel is een persoonsgegeven en is naar zijn aard bedoeld om iemand terug te herkennen. Behandel het daarnaar. Concreet betekent dat: vertel de betrokkenen dat je stemmen laat onthouden, bewaar geen profielen van mensen die dat niet willen, en wis een profiel als iemand daarom vraagt. Omdat alles lokaal staat, is er geen dienst die dat voor je regelt — verwijderen is jouw eigen handeling, in de app op je eigen Mac.
Wij claimen uitdrukkelijk geen bepaalde nauwkeurigheid van de toewijzing en geen geschiktheid om iemand mee te identificeren.
Hoe betrouwbaar is de toewijzing?
Bij netjes opgenomen gesprekken met twee tot vier mensen die elkaar laten uitpraten, is de scheiding in de regel goed bruikbaar. Lastiger wordt het hier:
| Situatie | Resultaat | Wat helpt |
|---|---|---|
| Twee personen, headsets, duidelijke beurtwisseling | Zeer betrouwbaar | — |
| Vier tot zes mensen aan tafel | Bruikbaar, met correcties | Microfoon dichter bij de groep |
| Door elkaar praten | Foutgevoelig | Fragment terugluisteren en handmatig toewijzen |
| Sterk gelijkende stemmen | Deels door elkaar gehaald | Blokken met de hand splitsen |
| Korte tussenwerpsels (“hm”, “ja”) | Vaak aan de verkeerde spreker | Negeren of corrigeren |
| Slechte telefoonlijn | Zwak | Aan beide kanten lokaal opnemen |
Ook het aantal sprekers wordt geschat, niet gegarandeerd. Zit er iemand in de opname die maar twee zinnen zegt, dan is de kans reëel dat die bij een ander wordt ingedeeld. Weet je vooraf hoeveel mensen er meedoen, dan kun je dat aantal opgeven, wat de schatting meestal verbetert.
De opname bepaalt het resultaat
Sprekerscheiding werkt op klankverschillen, dus elke verbetering van de opname wint het van elke instelling. Drie dingen leveren in de praktijk het meeste op. Ten eerste afstand: hoe dichter de microfoon bij de sprekers, hoe scherper de stemafdruk. Ten tweede de ruimte — galm vervaagt precies de kenmerken die twee stemmen onderscheidbaar maken, dus een kale vergaderzaal met een glazen wand is het slechtst denkbare decor. Ten derde de gespreksleiding: een kort voorstelrondje aan het begin geeft elke stem een schoon, ononderbroken fragment om zich aan vast te houden — en maakt het benoemen achteraf een fluitje van een cent.
Waarom dit lokaal gebeurt
Sprekertoewijzing is juist nodig bij opnames die vertrouwelijk zijn: functioneringsgesprekken, intakes, interviews, cliëntgesprekken, onderzoeksdata. Precies dat materiaal aan een online dienst geven is bij veel organisaties het punt waar het plan sneuvelt.
Bij Lesskeys draaien de spraakherkenning én de sprekerscheiding op je eigen Mac. De opname wordt niet geüpload, er is geen account nodig en er is geen partij die het materiaal namens jou verwerkt. Dat is een beschrijving van de architectuur — geen uitspraak over de rechtmatigheid van jouw verwerking. Of je een bepaald gesprek mag opnemen, stemprofielen mag aanleggen en de uitkomsten mag bewaren, beoordeel je met je functionaris gegevensbescherming of privacyjurist; wij claimen geen AVG-conformiteit en geen certificering.
Toestemming en het opnemen van anderen
In Nederland is het opnemen van een gesprek waaraan je zelf deelneemt niet strafbaar: artikel 139a Sr gaat over het heimelijk opnemen van gesprekken waar je géén deelnemer aan bent. De strenge formuleringen op Duits- of Engelstalige pagina’s gelden hier dus niet zonder meer. “Niet strafbaar” is alleen niet “altijd toegestaan”: in werkverband val je buiten de huishoudelijke uitzondering van de AVG en heb je een grondslag nodig, heeft de ondernemingsraad een stem bij het monitoren van medewerkers, is de Autoriteit Persoonsgegevens de toezichthouder, en kan het delen of publiceren van een stiekeme opname alsnog onrechtmatig zijn.
In de praktijk werkt deze volgorde het beste:
- Meld aan het begin van het gesprek dat je opneemt, en waarvoor.
- Noteer de instemming in het verslag of de notulen.
- Zeg er apart bij dat je stemprofielen bewaart, als je die functie gebruikt.
- Maakt iemand bezwaar, neem dan niet op — met de hand meeschrijven kan altijd nog.
- Wis stemprofielen en opnames als daarom wordt gevraagd; dat doe je zelf, want alles staat lokaal.
Dit is een toelichting, geen juridisch advies. Meer over de vergadercontext staat bij notulen maken van een vergaderopname.
Systeemeisen en kosten
Vanaf macOS 13 (Ventura) op een Mac met Apple Silicon (M1 of nieuwer) — Apple Silicon is een eis, Intel-Macs worden niet ondersteund. Er worden 99 talen herkend, automatisch. Downloaden is gratis; de volledige versie schakel je vrij met een eenmalige in-app-aankoop van $49,99 (in de Nederlandse App Store in euro’s), geen abonnement. In de gratis versie zit 5 minuten dictaat per dag plus 5 audio- en 5 videotranscripties in totaal; opnemen en opnieuw laten uitwerken zijn onbeperkt.
Gratis te downloaden. Eenmalig betalen. Geen abonnement. · Pro eenmalig $49,99 (in de Nederlandse App Store in euro's) · macOS 13 of nieuwer
Veelgestelde vragen
Hoe zie ik in een transcript wie wat heeft gezegd?
De opname wordt automatisch per stem gescheiden, waarna het transcript uit blokken bestaat met een tijdcode en een sprekeraanduiding. Je benoemt één blok en alle blokken van dezelfde stem nemen die naam over. Verkeerde toewijzingen corrigeer je per blok.
Hoeveel sprekers kan de app onderscheiden?
Twee tot vier personen met duidelijke beurtwisselingen worden in de regel betrouwbaar gescheiden. Bij grotere groepen blijft het bruikbaar maar zijn correcties nodig. Het aantal sprekers wordt geschat, niet gegarandeerd; weet je het aantal vooraf, dan kun je dat opgeven.
Worden mijn opnames geüpload voor de sprekerscheiding?
Nee. Zowel de spraakherkenning als de sprekerscheiding draait op je eigen Mac. De opname verlaat het apparaat niet, er is geen account nodig en er is geen partij die het materiaal namens jou verwerkt.
Herkent de app dezelfde persoon in latere opnames?
Ja, als je stemprofielen bewaart. De vingerafdruk van een benoemde stem blijft lokaal opgeslagen en wordt in een volgende opname voorgesteld. Een stemprofiel is een persoonsgegeven, dus vertel de betrokkenen dat je het bewaart en wis het als daarom wordt gevraagd — dat doe je zelf, in de app.
Mag ik een gesprek met meerdere mensen opnemen?
In Nederland is het opnemen van een gesprek waaraan je zelf deelneemt niet strafbaar; artikel 139a Sr gaat over gesprekken waar je geen deelnemer aan bent. In werkverband heb je wel een grondslag onder de AVG nodig en heeft de ondernemingsraad een stem. Meld het aan het begin en noteer de instemming.
Kan ik op de sprekertoewijzing vertrouwen?
Het is een goede werkbasis, geen garantie. De software onderscheidt stemmen, ze identificeert geen personen, en wij claimen geen bepaalde nauwkeurigheid of geschiktheid voor identificatie. Belangrijke passages luister je terug voordat je ze gebruikt.