Pagina iniziale › Chi parla nella trascrizione

Funzione · Voci separate

Riconoscere chi parla in una trascrizione

Quando in una registrazione parlano più persone, un trascritto senza attribuzioni è quasi inservibile: leggi un muro di testo e non sai chi ha detto che cosa. Riconoscere chi parla è il passaggio che lo rende utilizzabile, e Lesskeys separa automaticamente le voci, assegna un'etichetta a ciascuna e ti lascia rinominarle; la stessa persona può essere riconosciuta anche in registrazioni successive. Tutto sul tuo Mac, senza caricare l'audio da nessuna parte.

100%in locale sul Mac — l'audio non viene mai caricato
Gratisda scaricare — Pro si sblocca con 49,99 $ una tantum, senza abbonamento
99lingue, riconosciute automaticamente
macOS 13+Apple Silicon (M1 o successivo)

Perché serve riconoscere chi parla

Un'intervista a due voci, una tavola rotonda, un focus group, un consiglio direttivo, una riunione con il cliente: in tutti questi casi il valore del trascritto sta nell'attribuzione. Una citazione senza autore non si può usare in un articolo, una decisione senza chi l'ha proposta non si può mettere a verbale, e una risposta di un partecipante a un focus group senza il partecipante è solo una frase.

Separare le voci è un lavoro che a mano richiede più tempo della trascrizione stessa: significa riascoltare, riconoscere e marcare a mano ogni cambio di turno. Farlo fare al software non elimina la revisione, ma sposta il lavoro dal «marcare tutto» al «correggere qualcosa».

Come funziona, in termini concreti

Il compito ha un nome tecnico — diarizzazione del parlante, speaker diarization in inglese — e risponde alla domanda «chi parla e quando». È un'operazione distinta dal riconoscimento vocale: uno stabilisce che cosa è stato detto, l'altra da chi. Solo insieme producono un trascritto leggibile.

Un punto importante per capire i limiti: il sistema riconosce differenze fra voci, non identità. Chi sia «Interlocutore 1» lo sa solo chi era presente — ed è per questo che i nomi li assegni tu.

Come si lavora, in pratica

Riconoscere la stessa persona in registrazioni diverse

Se registri spesso le stesse persone — una riunione settimanale, un ciclo di interviste, un gruppo di lavoro fisso — rinominare ogni volta da capo è un lavoro inutile. L'app può quindi conservare un profilo vocale: l'impronta di una voce già nominata resta salvata sul Mac e nella registrazione successiva la stessa persona viene proposta con il suo nome.

Questi profili meritano più attenzione del resto del materiale. La voce è un dato personale, e un profilo vocale è per sua natura un identificatore: prima di crearne uno, informa le persone coinvolte e raccogli il loro consenso, e non conservare profili di chi non è d'accordo. I profili restano sul tuo Mac e non vengono trasmessi a nessuno, ma la decisione di crearli è tua e resta tua la responsabilità.

Non dichiariamo alcuna garanzia di accuratezza dell'attribuzione, né alcuna idoneità a identificare una persona: lo strumento distingue voci in una registrazione, non certifica chi sia il proprietario di quella voce.

Quando l'attribuzione sbaglia

Con due o tre persone che si lasciano finire le frasi la separazione è affidabile. Ecco invece i casi difficili, e che cosa fare:

SituazioneRisultato tipicoChe cosa aiuta
Due persone, microfoni vicini, turni nettimolto affidabile
Quattro o sei persone intorno a un tavoloutilizzabile, con correzionimicrofono al centro del gruppo
Persone che parlano soprabattute mescolateriascoltare quei punti e correggere
Voci molto similiin parte confuse fra loroseparare i blocchi a mano
Interventi brevissimi («mh», «sì», «certo»)spesso attribuiti alla persona sbagliataignorarli o correggerli in blocco
Un solo microfono lontano, stanza che rimbombaseparazione debolecambiare la situazione di ripresa

Il fattore decisivo non è un'impostazione del software ma la registrazione: un microfono a clip su ciascuno, o un microfono da conferenza al centro del tavolo, migliorano il risultato più di qualunque parametro.

Tre accorgimenti che cambiano il risultato

Il primo è la distanza: più il microfono è vicino a chi parla, più l'impronta della voce è netta. Il secondo è la stanza: il riverbero confonde esattamente le caratteristiche che permettono di distinguere due timbri, quindi una sala vuota e piastrellata è il peggior posto possibile. Il terzo riguarda la conduzione: un breve giro di presentazioni all'inizio regala a ogni voce un tratto pulito e isolato su cui ancorare l'attribuzione, e rende immediato assegnare le etichette dopo — trenta secondi che ne fanno risparmiare parecchi in revisione.

Perché la separazione avviene in locale

Sapere chi ha detto che cosa serve quasi sempre su materiale delicato: colloqui di lavoro, interviste con fonti da proteggere, consulenze professionali, dati di ricerca, riunioni interne. È esattamente il materiale per cui affidarsi a un servizio esterno diventa una decisione da motivare.

Qui sia il riconoscimento vocale sia la separazione delle voci avvengono sul tuo Mac: l'audio non viene caricato, non c'è un fornitore che lo elabora per conto tuo e non serve un account. È una descrizione dell'architettura del software — non una valutazione sulla liceità del tuo trattamento, che dipende da finalità, base giuridica e soggetti coinvolti, e che va verificata con il tuo responsabile della protezione dei dati o con il tuo consulente legale. Non diamo alcuna garanzia sull'impiego di un trascritto come documento ufficiale nei confronti di terzi.

Prima di registrare altre persone

In Italia registrare una conversazione alla quale partecipi è lecito; captare una conversazione fra terzi a cui non prendi parte no, ed è penalmente rilevante (artt. 615-bis e 617 c.p.). Ma il punto pratico è un altro: l'uso e la diffusione di quell'audio e del trascritto sono una questione distinta dall'atto di registrare, e vanno pensati prima. Nel contesto di lavoro c'è poi l'art. 4 dello Statuto dei lavoratori (L. 300/1970), che subordina i controlli a distanza sull'attività dei dipendenti a un accordo sindacale o a un'autorizzazione dell'Ispettorato del lavoro. Una sequenza che funziona:

Sono indicazioni pratiche, non consulenza legale.

Requisiti e prezzo

Serve macOS 13 (Ventura) o successivo su un Mac con Apple Silicon (M1 o successivo): Apple Silicon è obbligatorio, i Mac Intel non sono supportati. Le lingue riconosciute automaticamente sono 99. Il download è gratuito; Pro si sblocca con un acquisto in-app una tantum da 49,99 $, senza abbonamento — l'App Store italiano mostra l'importo in euro. La versione gratuita comprende 5 minuti di dettatura al giorno e 5 trascrizioni audio più 5 video in totale, mentre registrare non è mai conteggiato e ritrascrivere una registrazione già elaborata non consuma quota.

Scarica dal Mac App Store

Download gratuito, versione gratuita con limiti. Nessun abbonamento. · Versione Pro: acquisto in-app una tantum da 49,99 $ (l'App Store italiano mostra l'importo in euro) · da macOS 13

Domande frequenti

Come faccio a riconoscere chi parla in una trascrizione?

L'app separa automaticamente le voci e consegna il trascritto diviso in blocchi, ciascuno con un marcatore temporale e un'etichetta. Rinomini un blocco e tutti gli altri della stessa voce ereditano il nome; le attribuzioni sbagliate si correggono una per una e due voci separate per errore si possono riunire.

Quante persone riesce a distinguere?

Con due o tre persone che si lasciano finire le frasi la separazione è affidabile. Con quattro o sei intorno a un tavolo il risultato resta utilizzabile ma richiede correzioni. Le fonti di errore tipiche sono le sovrapposizioni, le voci molto simili e gli interventi brevissimi.

L'audio viene caricato per separare le voci?

No. Sia il riconoscimento vocale sia la separazione delle voci avvengono sul tuo Mac: il file non lascia il computer, non serve un account e non c'è un fornitore che lo elabora per conto tuo.

Riconosce la stessa persona in registrazioni diverse?

Sì, se conservi i profili vocali: l'impronta di una voce già nominata resta salvata sul Mac e viene riproposta nella registrazione successiva. La voce è un dato personale, quindi informa le persone coinvolte e raccogli il loro consenso prima di creare un profilo.

Posso registrare una riunione e attribuire gli interventi?

Tecnicamente sì, anche registrando l'audio di sistema del Mac. Prima però avvisa i presenti: in Italia partecipare alla conversazione registrata è lecito, ma l'uso e la diffusione dell'audio e del trascritto sono un'altra questione, e in ambito di lavoro l'art. 4 dello Statuto dei lavoratori subordina i controlli a distanza sull'attività dei dipendenti a un accordo sindacale o a un'autorizzazione dell'Ispettorato del lavoro.

Posso fidarmi dell'attribuzione senza controllarla?

No: è una buona base di lavoro, non una garanzia. Il sistema distingue voci, non identifica persone, e non dichiariamo né un livello di accuratezza né un'idoneità all'identificazione. I passaggi importanti vanno riascoltati prima di riutilizzarli, usando i marcatori temporali.

Argomenti correlati