Αρχική › Διαχωρισμός ομιλητών
Ομιλητές · Ποιος είπε τι
Διαχωρισμός ομιλητών: ποιος μιλάει και πότε
Μια απομαγνητοφώνηση χωρίς ονόματα είναι ένα τείχος κειμένου. Το Lesskeys ξεχωρίζει αυτόματα τις φωνές μέσα στην ηχογράφηση και δίνει παραγράφους με ετικέτα ομιλητή και χρονοσήμανση — και όλα γίνονται πάνω στο Mac σας.
Το πρόβλημα: πενήντα σελίδες χωρίς ονόματα
Όποιος έχει απομαγνητοφωνήσει συνέντευξη ή συζήτηση πάνελ ξέρει το εξής: το πιο κουραστικό κομμάτι δεν είναι να γραφτούν οι λέξεις, είναι να καταλάβει κανείς ποιος τις είπε. Χωρίς αυτή την πληροφορία ένα κείμενο δύο ωρών είναι πρακτικά αχρησιμοποίητο — δεν παρατίθεται, δεν κωδικοποιείται, δεν ελέγχεται.
Ο διεθνής τεχνικός όρος γι' αυτή τη λειτουργία είναι diarization· στα ελληνικά τη λέμε διαχωρισμό ομιλητών, αλλά αυτό που ψάχνει στην πραγματικότητα ο κόσμος διατυπώνεται πιο απλά: «να ξεχωρίζουν οι φωνές», «να φαίνεται ποιος μιλάει».
Πώς ξεχωρίζονται οι φωνές
Η επεξεργασία γίνεται σε δύο άξονες πάνω στον ίδιο ήχο. Πρώτα εντοπίζεται πού υπάρχει ομιλία και πού σιωπή, ώστε ο ήχος να κοπεί σε κομμάτια. Μετά κάθε κομμάτι μετατρέπεται σε ένα αριθμητικό αποτύπωμα που περιγράφει τα χαρακτηριστικά της φωνής, και τα αποτυπώματα που μοιάζουν μεταξύ τους ομαδοποιούνται: αυτές οι ομάδες είναι οι ομιλητές. Παράλληλα η ομιλία μετατρέπεται σε κείμενο, και τα δύο αποτελέσματα ενώνονται, ώστε κάθε παράγραφος να φέρει ετικέτα και χρόνο.
Όλα αυτά τρέχουν στη GPU του Mac σας. Δεν υπάρχει μεταφόρτωση του ήχου και δεν χρειάζεται λογαριασμός. Η εφαρμογή απαιτεί Apple Silicon (M1 ή νεότερο) και macOS 13 ή νεότερο.
Ετικέτες, ονόματα και διορθώσεις
Αρχικά παίρνετε ουδέτερες ετικέτες τύπου «Ομιλητής 1» και «Ομιλητής 2». Τις μετονομάζετε σε πραγματικά ονόματα ή ρόλους — «Ερευνήτρια», «Συμμετέχων Α», «Πρόεδρος ΔΣ» — και η αλλαγή περνά αυτόματα σε ολόκληρο το κείμενο. Αν ένα κομμάτι έχει αποδοθεί σε λάθος φωνή, το διορθώνετε χειροκίνητα και μπορείτε να συγχωνεύσετε δύο ετικέτες όταν η ίδια φωνή έχει σπάσει σε δύο ομάδες.
Το κείμενο αποθηκεύεται σε τοπική βιβλιοθήκη με αναζήτηση: βρίσκετε μια φράση, όλες τις παρεμβάσεις ενός ομιλητή, ή ό,τι ειπώθηκε μια συγκεκριμένη ημερομηνία. Στην εξαγωγή, οι ετικέτες ακολουθούν το κείμενο· για υποτίτλους βγαίνουν επιπλέον SRT και VTT.
Αποθηκευμένα φωνητικά προφίλ — και η συγκατάθεση
Μια ετικέτα μπορεί να μείνει: αν αποθηκεύσετε το φωνητικό προφίλ ενός ομιλητή, το ίδιο άτομο αναγνωρίζεται και σε επόμενες ηχογραφήσεις, οπότε δεν ξαναδίνετε ονόματα από την αρχή. Για μια σειρά δέκα συνεντεύξεων με τον ίδιο ερευνητή, αυτό γλιτώνει δέκα φορές την ίδια δουλειά.
Ακριβώς επειδή είναι χρήσιμο, χρειάζεται και προσοχή: η φωνή είναι προσωπικό δεδομένο, και ένα αποθηκευμένο φωνητικό προφίλ είναι βιομετρικού χαρακτήρα πληροφορία. Ενημερώστε τα εμπλεκόμενα πρόσωπα και πάρτε τη συγκατάθεσή τους πριν δημιουργήσετε προφίλ, και μη δημιουργείτε προφίλ για ανθρώπους που απλώς πέρασαν από μια ηχογράφηση. Τα προφίλ μένουν αποθηκευμένα τοπικά στο Mac σας και δεν αποστέλλονται πουθενά· μπορείτε να τα διαγράψετε. Αυτή είναι περιγραφή της αρχιτεκτονικής, όχι δήλωση συμμόρφωσης: δεν διεκδικούμε πιστοποίηση με τον ΓΚΠΔ ή τον ν. 4624/2019, και η ΑΠΔΠΧ αναφέρεται μόνο ως εποπτική αρχή. Ελέγξτε τη δική σας επεξεργασία με τον υπεύθυνο προστασίας δεδομένων ή τον νομικό σας σύμβουλο.
Πριν πατήσετε ηχογράφηση
Στην Ελλάδα η καταγραφή ιδιωτικής προφορικής ή τηλεφωνικής συνομιλίας χωρίς να το γνωρίζουν οι συμμετέχοντες μπορεί να στοιχειοθετήσει ποινικό αδίκημα κατά το άρθρο 370Α ΠΚ — δεν είναι απλώς αστική διαφορά. Το άρθρο 19 του Συντάγματος προστατεύει το απόρρητο των επικοινωνιών και στην παράγραφο 3 απαγορεύει τη χρήση αποδεικτικών μέσων που αποκτήθηκαν κατά παράβασή του, ενώ στον χώρο εργασίας προστίθενται οι κατευθύνσεις της ΑΠΔΠΧ. Ο πρακτικός κανόνας είναι απλός: ενημερώνετε πριν αρχίσει η ηχογράφηση, καταγράφετε ότι οι παρόντες ενημερώθηκαν, και αν κάποιος αρνηθεί δεν ηχογραφείτε. Τα παραπάνω αφορούν την ελληνική έννομη τάξη· σε άλλη δικαιοδοσία, όπως στην Κύπρο, ισχύει διαφορετικό πλαίσιο. Ενημέρωση, όχι νομική συμβουλή. Δεν παρέχεται καμία εγγύηση νομικού κύρους για το παραγόμενο κείμενο.
Πού χρησιμεύει πραγματικά
- Δημοσιογραφία. Συνέντευξη δύο ατόμων όπου η ατάκα πρέπει να αποδοθεί με ακρίβεια σε αυτόν που την είπε, χωρίς να δοθεί το πρωτότυπο ηχητικό σε τρίτο πάροχο.
- Κοινωνική έρευνα. Ημιδομημένες συνεντεύξεις και ομάδες εστίασης, όπου η κωδικοποίηση προϋποθέτει ότι ξέρετε ποιος μιλά σε κάθε απόσπασμα.
- Έρευνα αγοράς. Ομάδες εστίασης με έξι ή οκτώ συμμετέχοντες, όπου ο χειροκίνητος διαχωρισμός των φωνών είναι ώρες δουλειάς.
- Συνεδριάσεις και πάνελ. Συζητήσεις με πολλούς ομιλητές, όπου το κείμενο χωρίς ετικέτες δεν διαβάζεται. Δείτε και τα πρακτικά συνεδρίασης.
- Επαγγελματίες με απόρρητο. Δικηγόροι, σύμβουλοι, τμήματα προσωπικού, όπου η αποστολή του ήχου σε εξωτερική υπηρεσία είναι αυτοτελής απόφαση.
Πού πέφτει η απόδοση — να το ξέρετε από πριν
Ο διαχωρισμός ομιλητών δεν είναι λυμένο πρόβλημα, σε κανένα σύστημα. Τα σημεία που χαλάνε το αποτέλεσμα είναι συγκεκριμένα και προβλέψιμα:
- Ταυτόχρονη ομιλία. Όταν δύο άνθρωποι μιλούν μαζί ή κόβει ο ένας τον άλλο, η απόδοση λερώνεται — και το κείμενο και η ετικέτα.
- Ένα μικρόφωνο σε αίθουσα με ηχώ. Απόσταση, αντήχηση και θόρυβος κλιματισμού μειώνουν αισθητά την ποιότητα του διαχωρισμού.
- Παρόμοιες φωνές. Δύο ομιλητές με κοντινή χροιά μπορεί να συγχωνευθούν σε μία ετικέτα.
- Πολύ σύντομες παρεμβάσεις. Ένα «ναι» ή ένα «σωστά» δεν δίνει αρκετό υλικό για να αναγνωριστεί με βεβαιότητα η φωνή.
- Πολλοί ομιλητές. Όσο μεγαλώνει ο αριθμός, τόσο πιθανότερο είναι να χρειαστούν συγχωνεύσεις και χειροκίνητες διορθώσεις.
Γι' αυτό οι ετικέτες θέλουν ένα πέρασμα με το μάτι. Το κέρδος δεν είναι η τελειότητα, είναι ότι ξεκινάτε από ένα ήδη χωρισμένο κείμενο αντί από μηδέν.
Πώς να ηχογραφείτε για καλύτερο διαχωρισμό
Η ποιότητα του ήχου μετράει περισσότερο από κάθε ρύθμιση λογισμικού. Βάλτε το μικρόφωνο όσο πιο κοντά γίνεται στους ομιλητές και όχι στο κέντρο ενός μεγάλου τραπεζιού. Προτιμήστε δωμάτιο με λίγη αντήχηση. Στην αρχή της ηχογράφησης ζητήστε από κάθε συμμετέχοντα να πει μία πρόταση με το όνομά του: έχετε έτσι καθαρό δείγμα φωνής και σαφή αντιστοίχιση, και ταυτόχρονα μένει καταγεγραμμένο ότι ενημερώθηκαν. Για διαδικτυακές συσκέψεις, η καταγραφή του ήχου συστήματος του Mac δουλεύει ανεξάρτητα από την πλατφόρμα, χωρίς να μπαίνει bot στη συνεδρίαση.
Απαιτήσεις, δωρεάν έκδοση και τιμή
| Σημείο | Στοιχείο |
|---|---|
| Λειτουργικό | macOS 13 (Ventura) ή νεότερο |
| Επεξεργαστής | Apple Silicon (M1 ή νεότερο) — απαίτηση |
| Γλώσσες | 99, με αυτόματη αναγνώριση |
| Φωνητικά προφίλ | αποθηκεύονται τοπικά, διαγράφονται από εσάς |
| Τιμή | δωρεάν λήψη· Pro με εφάπαξ αγορά εντός εφαρμογής 49,99 $ — χωρίς συνδρομή |
| Δωρεάν έκδοση | 5 απομαγνητοφωνήσεις ήχου και 5 βίντεο συνολικά· 5 λεπτά υπαγόρευσης την ημέρα |
| Χωρίς μέτρηση | η ηχογράφηση και η επανάληψη σε ήδη επεξεργασμένο υλικό |
Οι 5 απομαγνητοφωνήσεις ήχου και οι 5 βίντεο της δωρεάν έκδοσης είναι συνολικά, όχι ανά ημέρα: αρκούν για να δείτε πώς αποδίδει ο διαχωρισμός ομιλητών σε δικές σας ηχογραφήσεις πριν αγοράσετε. Η ηχογράφηση δεν μετριέται ποτέ και η επανάληψη σε κάτι ήδη επεξεργασμένο είναι δωρεάν. Η τιμή σε δολάρια είναι η τιμή αναφοράς του καταστήματος· στο ελληνικό App Store η χρέωση γίνεται στο αντίστοιχο ποσό σε ευρώ.
Δωρεάν λήψη, δωρεάν έκδοση με όρια. Χωρίς συνδρομή. · Pro: εφάπαξ αγορά εντός εφαρμογής 49,99 $ (το ελληνικό App Store χρεώνει σε ευρώ) · από macOS 13
Συχνές ερωτήσεις
Τι είναι ο διαχωρισμός ομιλητών;
Είναι η αυτόματη αναγνώριση του ποιος μιλάει σε κάθε σημείο μιας ηχογράφησης. Ο ήχος κόβεται σε κομμάτια, κάθε κομμάτι αποκτά ένα αποτύπωμα φωνής, και τα όμοια αποτυπώματα ομαδοποιούνται σε ομιλητές. Το τελικό κείμενο βγαίνει σε παραγράφους με ετικέτα ομιλητή και χρονοσήμανση.
Μπορώ να δώσω πραγματικά ονόματα στους ομιλητές;
Ναι. Μετονομάζετε το «Ομιλητής 1» σε όνομα ή ρόλο και η αλλαγή περνά σε όλο το κείμενο. Μπορείτε επίσης να διορθώσετε κομμάτια που αποδόθηκαν σε λάθος φωνή και να συγχωνεύσετε δύο ετικέτες όταν η ίδια φωνή έχει σπάσει σε δύο ομάδες.
Αναγνωρίζεται το ίδιο άτομο σε διαφορετικές ηχογραφήσεις;
Ναι, αν αποθηκεύσετε φωνητικό προφίλ. Επειδή όμως η φωνή είναι προσωπικό δεδομένο, ενημερώστε τα εμπλεκόμενα πρόσωπα και πάρτε τη συγκατάθεσή τους πριν δημιουργήσετε προφίλ. Τα προφίλ μένουν τοπικά στο Mac και μπορείτε να τα διαγράψετε.
Πόσο αξιόπιστος είναι ο διαχωρισμός όταν μιλούν πολλοί μαζί;
Χειροτερεύει, όπως σε κάθε σύστημα. Ταυτόχρονη ομιλία, ένα μικρόφωνο σε αίθουσα με ηχώ, πολύ σύντομες παρεμβάσεις και φωνές με κοντινή χροιά είναι οι τυπικές αιτίες λάθους. Υπολογίστε ένα πέρασμα διόρθωσης στις ετικέτες.
Λειτουργεί με συσκέψεις σε Teams, Zoom ή Google Meet;
Ναι, γιατί καταγράφεται ο ήχος συστήματος του Mac και όχι κάποια συγκεκριμένη πλατφόρμα· δεν μπαίνει bot στη συνεδρίαση και δεν ζητείται πρόσβαση στο ημερολόγιό σας. Ενημερώστε πρώτα τους συμμετέχοντες, γιατί στην Ελλάδα η ηχογράφηση εν αγνοία τους μπορεί να στοιχειοθετήσει ποινικό αδίκημα κατά το άρθρο 370Α ΠΚ.
Ανεβαίνει ο ήχος κάπου για να γίνει ο διαχωρισμός;
Όχι. Ο διαχωρισμός ομιλητών και η απομαγνητοφώνηση τρέχουν στη GPU του Mac σας, χωρίς λογαριασμό και χωρίς μεταφόρτωση. Χρειάζεται Apple Silicon, δηλαδή M1 ή νεότερο, και macOS 13 ή νεότερο.