Beranda › Siapa bicara di rekaman
Fitur · Pemisahan pembicara
Siapa bicara di rekaman: transkrip berlabel nama
Transkrip tanpa label pembicara hampir tidak berguna begitu yang bicara lebih dari satu orang: pertanyaan siapa bicara di rekaman tetap tidak terjawab. Lesskeys memisahkan rekaman per pembicara secara otomatis, membiarkan Anda memberi nama, lalu mengenali orang yang sama di rekaman berikutnya. Semuanya diproses di Mac Anda, tanpa akun dan tanpa unggahan.
Cara aplikasi tahu siapa bicara di rekaman: memisahkan suara, bukan mengenali orang
Transkrip rapat empat orang yang tidak berlabel praktis tidak terpakai — yang terbaca hanya dinding teks, dan Anda tetap harus memutar ulang rekamannya untuk tahu siapa mengatakan apa. Pemisahan pembicara menjawab pertanyaan "siapa bicara kapan", terpisah dari pengenalan suara yang menjawab "apa yang dikatakan". Keduanya baru berguna kalau digabung. Dalam istilah teknis, prosesnya disebut diarisasi pembicara.
Prosesnya berjalan bertahap. Pertama ditentukan bagian mana yang berisi ucapan dan mana yang hening. Lalu untuk setiap potongan ucapan dihitung semacam sidik suara — deretan angka yang menggambarkan warna dan karakter suara. Sidik-sidik itu kemudian dikelompokkan: potongan dengan sidik yang mirip besar kemungkinan berasal dari orang yang sama. Terakhir, potongan berurutan dari orang yang sama digabung supaya transkripnya tidak berganti paragraf setiap lima detik.
Satu hal penting untuk dipahami: yang dikenali aplikasi adalah perbedaan antar suara, bukan identitas orang. Siapa "Pembicara 1" itu hanya diketahui oleh Anda yang hadir di rekaman — karena itulah penamaan dilakukan oleh Anda.
Alurnya di aplikasi
- Rekam atau seret berkas. Mikrofon dan suara sistem Mac bisa direkam sekaligus, jadi rapat Zoom, Teams, Google Meet, dan panggilan WhatsApp Desktop sama saja — tidak ada bot yang perlu masuk ke ruang rapat. Berkas lama juga bisa dijatuhkan langsung ke jendela aplikasi.
- Pemisahan otomatis. Setelah pemrosesan selesai, transkripnya sudah terbagi per bagian, masing-masing dengan penanda waktu dan label pembicara sementara.
- Beri nama. Anda menamai satu bagian, dan semua bagian dengan suara yang sama ikut bernama.
- Perbaiki. Bagian yang salah label bisa dipindahkan ke pembicara lain, dan dua kelompok yang sebenarnya satu orang bisa digabungkan.
- Cari dan ekspor. Isi transkrip bisa dicari, termasuk per pembicara, lalu diekspor sebagai teks atau sebagai subtitle.
Profil suara: dikenali lagi di rekaman berikutnya
Kalau Anda rutin merekam orang yang sama — rapat mingguan, seri wawancara, sesi bimbingan — memberi nama dari nol setiap kali itu melelahkan. Karena itu nama yang sudah Anda berikan bisa disimpan sebagai profil suara: sidik suaranya tersimpan secara lokal di Mac Anda, dan di rekaman berikutnya orang yang sama langsung diusulkan dengan namanya.
Fitur ini perlu diperlakukan lebih hati-hati daripada isi transkrip biasa. Profil suara adalah data biometrik, dan di bawah UU Pelindungan Data Pribadi data biometrik tergolong data pribadi yang bersifat spesifik, sehingga pengolahannya menuntut persetujuan yang jelas dari orang yang bersangkutan. Praktik yang sehat cukup sederhana: beri tahu orangnya bahwa profil suaranya disimpan supaya dikenali lagi di rekaman berikutnya, minta persetujuannya, dan hapus profil itu bila diminta. Karena semuanya tersimpan lokal, penghapusan itu ada di tangan Anda sendiri — tidak ada pihak lain yang bisa melakukannya untuk Anda, dan tidak ada pihak lain yang menyimpan salinannya.
Kami tidak menyatakan kepatuhan terhadap UU PDP maupun sertifikasi apa pun. Yang bisa kami jelaskan adalah arsitekturnya: profil suara tidak pernah dikirim ke server. Apakah pengolahan yang Anda lakukan sah, pastikan dengan penasihat hukum atau tim kepatuhan Anda. Ini informasi umum, bukan nasihat hukum.
Seberapa bisa diandalkan labelnya
Untuk rekaman yang bersih dengan dua sampai empat orang yang saling menunggu giliran bicara, hasilnya biasanya sudah langsung terpakai. Yang menyulitkan justru situasi yang sangat lazim di lapangan:
| Situasi | Hasil | Yang membantu |
|---|---|---|
| Dua orang, headset, pergantian jelas | Sangat andal | — |
| Empat sampai enam orang satu meja | Terpakai, perlu koreksi | Dekatkan mikrofon ke tengah |
| Orang menyela dan bicara bersamaan | Rawan salah | Dengarkan ulang, perbaiki manual |
| Suara sangat mirip, misalnya saudara kandung | Sebagian tercampur | Pisahkan bagiannya secara manual |
| Sambungan telepon berkualitas rendah | Lemah | Rekam dari sisi yang jernih bila bisa |
| Celetukan pendek seperti "iya", "hmm" | Sering salah label | Abaikan atau perbaiki |
| Satu mikrofon di ujung ruangan | Lemah | Ubah cara merekamnya |
Jumlah pembicara juga diperkirakan, bukan dijamin: satu orang bisa terpecah menjadi dua label kalau suaranya berubah — misalnya berpindah dari headset ke speakerphone — dan dua orang bisa tergabung kalau karakter suaranya berdekatan. Keduanya bisa Anda perbaiki dalam beberapa klik, tetapi tetap harus diperiksa.
Rekamannya yang paling menentukan
Pemisahan pembicara bekerja dari perbedaan bunyi, jadi setiap perbaikan pada cara merekam mengalahkan pengaturan apa pun di aplikasi. Tiga hal yang paling berpengaruh: jarak, karena makin dekat mikrofon ke pembicara makin bersih sidik suaranya; ruangan, karena gema mengaburkan persis ciri-ciri yang membedakan dua suara; dan cara rapat dipimpin, karena perkenalan singkat di awal memberi setiap suara satu potongan bersih yang tidak tertimpa siapa pun — dan sekaligus memudahkan Anda menamainya nanti.
Kenapa pemisahan ini dijalankan lokal
Label pembicara justru paling dibutuhkan pada rekaman yang paling sensitif: rapat internal, wawancara penelitian, sesi konsultasi, percakapan dengan klien, dan pemeriksaan internal kepegawaian. Menyerahkan materi seperti itu ke layanan online adalah titik di mana banyak rencana berhenti, biasanya bukan karena teknologinya, melainkan karena kebijakan tempat kerja.
Di Lesskeys, baik pengenalan suara maupun pemisahan pembicara dijalankan di Mac Anda. Berkas audionya tidak diunggah, tidak ada akun yang perlu dibuat, dan tidak ada pihak ketiga yang menerima rekaman Anda. Perlu diketahui juga bahwa Putusan Mahkamah Konstitusi No. 20/PUU-XIV/2016 membuat kedudukan rekaman pribadi sangat terbatas, sehingga tidak ada jaminan sebuah transkrip berlaku sebagai alat bukti — sebutan label pembicara di dalamnya tidak mengubah hal itu.
Izin: umumkan di awal, catat di notulen
Merekam percakapan yang Anda ikuti sendiri pada umumnya bukan penyadapan, karena UU ITE mendefinisikan intersepsi sebagai perekaman oleh pihak yang bukan peserta komunikasi. Tetapi itu bukan izin bebas. Suara peserta lain adalah data pribadi, apalagi ketika profil suaranya disimpan, dan menyebarkan rekaman atau transkrip kepada pihak ketiga tanpa persetujuan dapat berujung sanksi, termasuk sanksi pidana.
- Umumkan di awal, dengan kalimat yang lazim dipakai: "mohon izin rapat ini saya rekam untuk keperluan notulen".
- Sebutkan juga kalau Anda menyimpan profil suara supaya orang yang sama dikenali di rekaman berikutnya.
- Catat persetujuannya di notulen, bukan hanya diingat.
- Kalau ada yang keberatan, jangan direkam — mencatat manual selalu tetap mungkin.
- Hapus profil suara begitu diminta, dan hapus juga rekaman yang sudah tidak diperlukan.
Syarat dan biaya
Berjalan di macOS 13 (Ventura) ke atas, di Mac dengan Apple Silicon (M1 atau lebih baru; Mac Intel tidak didukung). 99 bahasa dikenali dengan deteksi otomatis. Aplikasinya gratis diunduh: versi gratis mencakup dikte 5 menit per hari serta 5 transkrip audio dan 5 transkrip video sebagai jumlah total seumur pemakaian, sementara merekam tidak pernah dibatasi dan mentranskrip ulang berkas yang sudah pernah diproses tidak memotong kuota. Pro dibuka dengan pembelian dalam aplikasi sekali bayar $49,99 — bukan langganan, ditagih dalam rupiah oleh App Store Indonesia.
Gratis diunduh. Bayar sekali untuk membuka Pro. Tanpa langganan. · Pro $49,99 sekali bayar (ditagih dalam rupiah) · macOS 13 ke atas
Pertanyaan Umum
Bagaimana cara tahu siapa bicara apa di dalam transkrip?
Lesskeys memisahkan rekaman berdasarkan suara secara otomatis, lalu menyusun transkrip per bagian dengan penanda waktu dan label pembicara. Anda menamai satu bagian, dan semua bagian dengan suara yang sama ikut bernama. Label yang salah bisa dipindahkan ke pembicara lain satu per satu.
Berapa banyak pembicara yang bisa dibedakan?
Dua sampai empat orang dengan pergantian bicara yang jelas biasanya terpisah dengan baik. Untuk rapat yang lebih ramai hasilnya masih terpakai tetapi perlu koreksi. Jumlah pembicara sifatnya perkiraan, bukan jaminan: satu orang bisa terpecah dua label, dan dua suara yang mirip bisa tergabung.
Apakah rekaman saya diunggah untuk memisahkan pembicara?
Tidak. Pengenalan suara maupun pemisahan pembicara sama-sama dijalankan di Mac Anda. Berkas audionya tidak keluar dari perangkat, tidak ada akun yang perlu dibuat, dan tidak ada pihak ketiga yang menerima rekaman Anda.
Apakah orang yang sama dikenali lagi di rekaman berikutnya?
Bisa, kalau Anda menyimpan profil suaranya. Sidik suara yang sudah dinamai tersimpan lokal di Mac dan diusulkan lagi pada rekaman berikutnya. Karena profil suara adalah data biometrik, beri tahu orang yang bersangkutan, minta persetujuannya, dan hapus profil itu bila diminta.
Apakah menyimpan profil suara orang lain boleh?
Profil suara tergolong data biometrik, dan di bawah UU PDP data biometrik termasuk data pribadi yang bersifat spesifik sehingga menuntut persetujuan yang jelas. Beri tahu orangnya, minta izin, dan hapus bila diminta. Kami tidak menyatakan kepatuhan atau sertifikasi apa pun — pastikan dengan penasihat hukum atau tim kepatuhan Anda.
Bisakah saya mengandalkan label pembicaranya sepenuhnya?
Sebagai bahan kerja, ya; sebagai jaminan, tidak. Suara yang sangat mirip, sambungan telepon berkualitas rendah, orang yang menyela, dan celetukan pendek seperti "iya" atau "hmm" masih menghasilkan salah label yang harus diperbaiki manual. Perlu diketahui pula bahwa tidak ada jaminan transkrip berlaku sebagai alat bukti.