Beranda › Siapa bicara di rekaman

Fitur · Pemisahan pembicara

Siapa bicara di rekaman: transkrip berlabel nama

Transkrip tanpa label pembicara hampir tidak berguna begitu yang bicara lebih dari satu orang: pertanyaan siapa bicara di rekaman tetap tidak terjawab. Lesskeys memisahkan rekaman per pembicara secara otomatis, membiarkan Anda memberi nama, lalu mengenali orang yang sama di rekaman berikutnya. Semuanya diproses di Mac Anda, tanpa akun dan tanpa unggahan.

100%diproses di Mac — audio tidak pernah diunggah
Gratisdiunduh — Pro sekali bayar $49,99
99bahasa, terdeteksi otomatis
macOS 13+Apple Silicon (M1 atau lebih baru)

Cara aplikasi tahu siapa bicara di rekaman: memisahkan suara, bukan mengenali orang

Transkrip rapat empat orang yang tidak berlabel praktis tidak terpakai — yang terbaca hanya dinding teks, dan Anda tetap harus memutar ulang rekamannya untuk tahu siapa mengatakan apa. Pemisahan pembicara menjawab pertanyaan "siapa bicara kapan", terpisah dari pengenalan suara yang menjawab "apa yang dikatakan". Keduanya baru berguna kalau digabung. Dalam istilah teknis, prosesnya disebut diarisasi pembicara.

Prosesnya berjalan bertahap. Pertama ditentukan bagian mana yang berisi ucapan dan mana yang hening. Lalu untuk setiap potongan ucapan dihitung semacam sidik suara — deretan angka yang menggambarkan warna dan karakter suara. Sidik-sidik itu kemudian dikelompokkan: potongan dengan sidik yang mirip besar kemungkinan berasal dari orang yang sama. Terakhir, potongan berurutan dari orang yang sama digabung supaya transkripnya tidak berganti paragraf setiap lima detik.

Satu hal penting untuk dipahami: yang dikenali aplikasi adalah perbedaan antar suara, bukan identitas orang. Siapa "Pembicara 1" itu hanya diketahui oleh Anda yang hadir di rekaman — karena itulah penamaan dilakukan oleh Anda.

Alurnya di aplikasi

Profil suara: dikenali lagi di rekaman berikutnya

Kalau Anda rutin merekam orang yang sama — rapat mingguan, seri wawancara, sesi bimbingan — memberi nama dari nol setiap kali itu melelahkan. Karena itu nama yang sudah Anda berikan bisa disimpan sebagai profil suara: sidik suaranya tersimpan secara lokal di Mac Anda, dan di rekaman berikutnya orang yang sama langsung diusulkan dengan namanya.

Fitur ini perlu diperlakukan lebih hati-hati daripada isi transkrip biasa. Profil suara adalah data biometrik, dan di bawah UU Pelindungan Data Pribadi data biometrik tergolong data pribadi yang bersifat spesifik, sehingga pengolahannya menuntut persetujuan yang jelas dari orang yang bersangkutan. Praktik yang sehat cukup sederhana: beri tahu orangnya bahwa profil suaranya disimpan supaya dikenali lagi di rekaman berikutnya, minta persetujuannya, dan hapus profil itu bila diminta. Karena semuanya tersimpan lokal, penghapusan itu ada di tangan Anda sendiri — tidak ada pihak lain yang bisa melakukannya untuk Anda, dan tidak ada pihak lain yang menyimpan salinannya.

Kami tidak menyatakan kepatuhan terhadap UU PDP maupun sertifikasi apa pun. Yang bisa kami jelaskan adalah arsitekturnya: profil suara tidak pernah dikirim ke server. Apakah pengolahan yang Anda lakukan sah, pastikan dengan penasihat hukum atau tim kepatuhan Anda. Ini informasi umum, bukan nasihat hukum.

Seberapa bisa diandalkan labelnya

Untuk rekaman yang bersih dengan dua sampai empat orang yang saling menunggu giliran bicara, hasilnya biasanya sudah langsung terpakai. Yang menyulitkan justru situasi yang sangat lazim di lapangan:

SituasiHasilYang membantu
Dua orang, headset, pergantian jelasSangat andal
Empat sampai enam orang satu mejaTerpakai, perlu koreksiDekatkan mikrofon ke tengah
Orang menyela dan bicara bersamaanRawan salahDengarkan ulang, perbaiki manual
Suara sangat mirip, misalnya saudara kandungSebagian tercampurPisahkan bagiannya secara manual
Sambungan telepon berkualitas rendahLemahRekam dari sisi yang jernih bila bisa
Celetukan pendek seperti "iya", "hmm"Sering salah labelAbaikan atau perbaiki
Satu mikrofon di ujung ruanganLemahUbah cara merekamnya

Jumlah pembicara juga diperkirakan, bukan dijamin: satu orang bisa terpecah menjadi dua label kalau suaranya berubah — misalnya berpindah dari headset ke speakerphone — dan dua orang bisa tergabung kalau karakter suaranya berdekatan. Keduanya bisa Anda perbaiki dalam beberapa klik, tetapi tetap harus diperiksa.

Rekamannya yang paling menentukan

Pemisahan pembicara bekerja dari perbedaan bunyi, jadi setiap perbaikan pada cara merekam mengalahkan pengaturan apa pun di aplikasi. Tiga hal yang paling berpengaruh: jarak, karena makin dekat mikrofon ke pembicara makin bersih sidik suaranya; ruangan, karena gema mengaburkan persis ciri-ciri yang membedakan dua suara; dan cara rapat dipimpin, karena perkenalan singkat di awal memberi setiap suara satu potongan bersih yang tidak tertimpa siapa pun — dan sekaligus memudahkan Anda menamainya nanti.

Kenapa pemisahan ini dijalankan lokal

Label pembicara justru paling dibutuhkan pada rekaman yang paling sensitif: rapat internal, wawancara penelitian, sesi konsultasi, percakapan dengan klien, dan pemeriksaan internal kepegawaian. Menyerahkan materi seperti itu ke layanan online adalah titik di mana banyak rencana berhenti, biasanya bukan karena teknologinya, melainkan karena kebijakan tempat kerja.

Di Lesskeys, baik pengenalan suara maupun pemisahan pembicara dijalankan di Mac Anda. Berkas audionya tidak diunggah, tidak ada akun yang perlu dibuat, dan tidak ada pihak ketiga yang menerima rekaman Anda. Perlu diketahui juga bahwa Putusan Mahkamah Konstitusi No. 20/PUU-XIV/2016 membuat kedudukan rekaman pribadi sangat terbatas, sehingga tidak ada jaminan sebuah transkrip berlaku sebagai alat bukti — sebutan label pembicara di dalamnya tidak mengubah hal itu.

Izin: umumkan di awal, catat di notulen

Merekam percakapan yang Anda ikuti sendiri pada umumnya bukan penyadapan, karena UU ITE mendefinisikan intersepsi sebagai perekaman oleh pihak yang bukan peserta komunikasi. Tetapi itu bukan izin bebas. Suara peserta lain adalah data pribadi, apalagi ketika profil suaranya disimpan, dan menyebarkan rekaman atau transkrip kepada pihak ketiga tanpa persetujuan dapat berujung sanksi, termasuk sanksi pidana.

Syarat dan biaya

Berjalan di macOS 13 (Ventura) ke atas, di Mac dengan Apple Silicon (M1 atau lebih baru; Mac Intel tidak didukung). 99 bahasa dikenali dengan deteksi otomatis. Aplikasinya gratis diunduh: versi gratis mencakup dikte 5 menit per hari serta 5 transkrip audio dan 5 transkrip video sebagai jumlah total seumur pemakaian, sementara merekam tidak pernah dibatasi dan mentranskrip ulang berkas yang sudah pernah diproses tidak memotong kuota. Pro dibuka dengan pembelian dalam aplikasi sekali bayar $49,99 — bukan langganan, ditagih dalam rupiah oleh App Store Indonesia.

Unduh di Mac App Store

Gratis diunduh. Bayar sekali untuk membuka Pro. Tanpa langganan. · Pro $49,99 sekali bayar (ditagih dalam rupiah) · macOS 13 ke atas

Pertanyaan Umum

Bagaimana cara tahu siapa bicara apa di dalam transkrip?

Lesskeys memisahkan rekaman berdasarkan suara secara otomatis, lalu menyusun transkrip per bagian dengan penanda waktu dan label pembicara. Anda menamai satu bagian, dan semua bagian dengan suara yang sama ikut bernama. Label yang salah bisa dipindahkan ke pembicara lain satu per satu.

Berapa banyak pembicara yang bisa dibedakan?

Dua sampai empat orang dengan pergantian bicara yang jelas biasanya terpisah dengan baik. Untuk rapat yang lebih ramai hasilnya masih terpakai tetapi perlu koreksi. Jumlah pembicara sifatnya perkiraan, bukan jaminan: satu orang bisa terpecah dua label, dan dua suara yang mirip bisa tergabung.

Apakah rekaman saya diunggah untuk memisahkan pembicara?

Tidak. Pengenalan suara maupun pemisahan pembicara sama-sama dijalankan di Mac Anda. Berkas audionya tidak keluar dari perangkat, tidak ada akun yang perlu dibuat, dan tidak ada pihak ketiga yang menerima rekaman Anda.

Apakah orang yang sama dikenali lagi di rekaman berikutnya?

Bisa, kalau Anda menyimpan profil suaranya. Sidik suara yang sudah dinamai tersimpan lokal di Mac dan diusulkan lagi pada rekaman berikutnya. Karena profil suara adalah data biometrik, beri tahu orang yang bersangkutan, minta persetujuannya, dan hapus profil itu bila diminta.

Apakah menyimpan profil suara orang lain boleh?

Profil suara tergolong data biometrik, dan di bawah UU PDP data biometrik termasuk data pribadi yang bersifat spesifik sehingga menuntut persetujuan yang jelas. Beri tahu orangnya, minta izin, dan hapus bila diminta. Kami tidak menyatakan kepatuhan atau sertifikasi apa pun — pastikan dengan penasihat hukum atau tim kepatuhan Anda.

Bisakah saya mengandalkan label pembicaranya sepenuhnya?

Sebagai bahan kerja, ya; sebagai jaminan, tidak. Suara yang sangat mirip, sambungan telepon berkualitas rendah, orang yang menyela, dan celetukan pendek seperti "iya" atau "hmm" masih menghasilkan salah label yang harus diperbaiki manual. Perlu diketahui pula bahwa tidak ada jaminan transkrip berlaku sebagai alat bukti.

Baca juga