หน้าแรก › วิธีถอดเสียงเป็นข้อความ
คู่มือทำตามได้จริง
วิธีถอดเสียงเป็นข้อความบน Mac ทีละขั้นตอน
หน้านี้เป็นขั้นตอนการทำงานจริงของการถอดเสียงเป็นข้อความบน Mac ตั้งแต่เตรียมไฟล์ ไปจนถึงส่งออกบทถอดที่ใช้งานได้ ทุกขั้นตอนทำได้บนเครื่องของคุณเอง โดยไม่ต้องอัปโหลดไฟล์ขึ้นเว็บของใคร และมีข้อควรระวังเฉพาะของภาษาไทยแทรกไว้ตามจุดที่มักพลาดกัน
ก่อนเริ่ม: เตรียมไฟล์ให้ถอดง่าย
คุณภาพของบทถอดถูกกำหนดตั้งแต่ตอนอัด ไม่ใช่ตอนถอด สองสามอย่างนี้ให้ผลต่างชัดที่สุด
- วางไมค์ให้ใกล้ผู้พูด ห้องประชุมที่มีผนังกระจกและเพดานสูงสะท้อนเสียงมาก ถ้าเป็นไปได้ให้วางเครื่องอัดไว้กลางวงและใกล้คนที่พูดมากที่สุด ดีกว่าวางไว้ปลายโต๊ะยาว
- ปิดเสียงรบกวนที่ควบคุมได้ แอร์ พัดลม เสียงพิมพ์คีย์บอร์ด และเพลงในร้าน มีผลกับความแม่นยำมากกว่าที่หลายคนคิด
- ถ้าเป็นการประชุมออนไลน์ ให้อัดจากฝั่ง Mac ของคุณ เสียงที่ผ่านระบบมาจะสะอาดกว่าการเอาไมค์ไปจ่อลำโพง
- ไฟล์ยาวมากให้แบ่งเป็นช่วง ถ้าต้องส่งงานเป็นตอนหรือแบ่งกันตรวจหลายคน การแบ่งไฟล์ตั้งแต่ต้นช่วยได้มากกว่ามาแบ่งทีหลัง
ขั้นที่ 1 นำเสียงเข้าเครื่อง
มีสองทางเข้า เลือกตามว่าคุณมีไฟล์อยู่แล้วหรือกำลังจะบันทึก
- มีไฟล์อยู่แล้ว — ลากไฟล์เสียงหรือไฟล์วิดีโอจาก Finder มาวางในหน้าต่างแอปได้เลย ไฟล์ที่อัดจากมือถือ เครื่องอัดเสียง หรือไฟล์ที่ส่งต่อกันมาใช้ได้ทั้งหมด
- กำลังจะบันทึก — สั่งบันทึกจากฝั่ง Mac ซึ่งจะเก็บทั้งเสียงระบบและเสียงไมค์ของคุณ ใช้ได้กับการประชุมออนไลน์โดยไม่ต้องเชิญบัญชีบอทเข้าห้อง
ถ้าเป็นไฟล์วิดีโอ แอปจะดึงเฉพาะเสียงออกมาถอดให้ คุณไม่ต้องแปลงไฟล์เองก่อน
ขั้นที่ 2 ให้เครื่องถอดเสียง
สั่งถอดแล้วรอ การรู้จำเสียงทำงานบนจีพียูของชิป Apple Silicon ในเครื่องคุณ ไม่มีการอัปโหลดไฟล์ออกไปไหน ระหว่างประมวลผลไฟล์ยาว ๆ เครื่องจะอุ่นขึ้นและพัดลมอาจทำงาน เป็นเรื่องปกติ
ภาษาถูกตรวจจับให้อัตโนมัติจาก 99 ภาษา ถ้างานของคุณวนอยู่กับสองสามภาษาเดิม การจำกัดรายการภาษาไว้ในการตั้งค่าจะช่วยให้ผลนิ่งขึ้น โดยเฉพาะกับช่วงที่พูดสั้นหรือพูดไม่ชัด ซึ่งเป็นจุดที่ระบบมักเดาภาษาผิด
ขั้นที่ 3 แยกและตั้งชื่อผู้พูด
ถ้าไฟล์มีคนพูดหลายคน แอปจะแยกให้ว่าช่วงไหนเป็นเสียงของใคร ตอนแรกจะขึ้นเป็นป้ายกลาง ๆ เช่น ผู้พูด 1 ผู้พูด 2 หน้าที่ของคุณคือเปลี่ยนเป็นชื่อจริง
จุดที่ประหยัดเวลาที่สุดคือ ตั้งชื่อครั้งเดียวแล้วใช้ต่อได้ในไฟล์ถัดไป ลายเสียงที่ตั้งชื่อไว้จะถูกเก็บไว้ในเครื่อง ทำให้ไฟล์ของการประชุมประจำสัปดาห์หรือการสัมภาษณ์ชุดเดียวกันขึ้นชื่อคนถูกมาตั้งแต่ต้น ไม่ต้องนั่งไล่ป้ายใหม่ทุกครั้ง
ถ้าแยกออกมาไม่ตรง เช่น คนเดียวถูกแตกเป็นสองผู้พูด หรือสองคนถูกรวมเป็นคนเดียว คุณแก้ในแอปได้ทั้งการรวมและการย้ายประโยคไปให้ผู้พูดคนอื่น รายละเอียดของกลไกนี้อยู่ในหน้า แยกเสียงผู้พูด
ขั้นที่ 4 ตรวจแก้ร่างแรก
ตรงนี้คือขั้นที่คนมักประเมินต่ำไป ผลที่ได้จากการถอดอัตโนมัติเป็นร่างแรก ไม่ใช่เอกสารที่ส่งได้ทันที สำหรับภาษาไทยมีสามจุดที่ต้องกวาดตาทุกครั้ง
- การตัดคำ ภาษาไทยเขียนติดกันไม่มีช่องว่างระหว่างคำ การตัดคำจึงเป็นการตีความของเครื่อง คำที่มีหลายความหมายและชื่อเฉพาะมักถูกตัดผิด
- วรรคตอนและการขึ้นย่อหน้า เครื่องเดาจากจังหวะการหยุดพูด ซึ่งไม่ตรงกับการเว้นวรรคตามหลักภาษาเสมอไป
- คำทับศัพท์และชื่อเฉพาะ ชื่อบริษัท ชื่อระบบ ศัพท์เทคนิคภาษาอังกฤษที่คนไทยพูดปนในประโยค เป็นจุดที่เพี้ยนบ่อยที่สุด แนะนำให้ใช้การค้นหาแล้วแทนที่ทีเดียวทั้งไฟล์ เร็วกว่าไล่แก้ทีละจุด
ในแอปคุณคลิกที่ข้อความเพื่อกระโดดไปฟังเสียงตรงตำแหน่งนั้นได้ ทำให้ตรวจเฉพาะจุดที่สงสัยได้โดยไม่ต้องฟังทั้งไฟล์ใหม่
ขั้นที่ 5 ส่งออก
รูปแบบที่ส่งออกได้จริงมีเท่านี้ ไม่ต้องหาปุ่มอื่น
| สิ่งที่ส่งออก | รูปแบบ | เหมาะกับ |
|---|---|---|
| บทถอดเสียง | TXT | เอาไปเรียบเรียงต่อในโปรแกรมเอกสารหรือส่งให้ทีมตรวจ |
| ซับไตเติ้ล | SRT, VTT | ใส่คำบรรยายในวิดีโอ อัปโหลดขึ้นแพลตฟอร์มวิดีโอ |
| ประวัติการถอด | TXT, JSON, CSV | ทำสถิติ ทำดัชนีค้นหา หรือส่งเข้าเครื่องมือวิเคราะห์ |
ถ้าปลายทางของคุณคือไฟล์เอกสารจัดรูปแบบ ให้ส่งออกเป็น TXT แล้ววางลงในโปรแกรมเอกสารที่คุณใช้อยู่ แอปไม่ได้ส่งออกเป็นไฟล์เอกสารสำเร็จรูปให้
เคล็ดลับที่ช่วยได้จริง
- ตั้งชื่อไฟล์ตามวันที่และหัวข้อตั้งแต่ตอนอัด จะหาย้อนหลังง่ายกว่าตั้งทีหลังมาก
- ถ้าสัมภาษณ์เป็นชุด ให้ใช้ชุดคำถามเดิมและตั้งชื่อผู้พูดให้เหมือนกันทุกไฟล์ เวลานำไปวิเคราะห์รวมจะไม่ต้องมานั่งไล่ชื่อ
- อ่านทวนสิบนาทีแรกก่อนตรวจทั้งไฟล์ ถ้าคำเฉพาะทางเพี้ยนซ้ำ ๆ ให้แก้ทีเดียวด้วยการแทนที่ทั้งไฟล์
- เก็บไฟล์เสียงต้นฉบับไว้เสมอ อย่าลบหลังถอดเสร็จ เพราะการสั่งถอดซ้ำไฟล์เดิมทำได้และไม่กินโควตา
ก่อนกดอัด เมื่อมีคนอื่นอยู่ในวง
ถ้าเสียงที่คุณกำลังบันทึกมีคนอื่นอยู่ด้วย ให้บอกด้วยวาจาก่อนเริ่มบันทึก ว่าจะบันทึกและบันทึกไว้เพื่ออะไร แล้วปล่อยให้ประโยคนั้นถูกบันทึกอยู่ในไฟล์ด้วย เช่น “ขออนุญาตบันทึกการประชุมนะครับ เพื่อใช้ทำรายงานการประชุมอย่างเดียว”
ในบริบทไทยมีข้อควรระวังเพิ่ม: ความเกรงใจทำให้ผู้ร่วมประชุมที่อาวุโสน้อยกว่าหรือคนนอกองค์กรมักไม่ทักท้วงต่อหน้าที่ประชุม การเงียบจึงไม่เท่ากับการยินยอม ถ้าเรื่องที่คุยมีความอ่อนไหว ให้ถามตรง ๆ เป็นรายคนหรือถามล่วงหน้าก่อนเข้าห้อง และถ้ามีใครไม่สะดวก ก็ควรไม่บันทึกจริง ๆ
ที่ต้องระวังมากกว่าการบันทึกคือการนำไปเผยแพร่ การโพสต์คลิปหรือบทถอดต่อสาธารณะโดยไม่ได้รับอนุญาตมีความเสี่ยงทางกฎหมายสูงกว่าการเก็บไว้ใช้ภายในมาก เพราะการหมิ่นประมาทในไทยเป็นความผิดอาญาตามประมวลกฎหมายอาญา มาตรา 326 ถึง 328 และการเผยแพร่ทางออนไลน์ยังอาจเกี่ยวข้องกับ พ.ร.บ.ว่าด้วยการกระทำความผิดเกี่ยวกับคอมพิวเตอร์อีกชั้นหนึ่ง เสียงของผู้อื่นยังเป็นข้อมูลส่วนบุคคลตาม พ.ร.บ.คุ้มครองข้อมูลส่วนบุคคล พ.ศ. 2562 ด้วย ข้อความนี้เป็นข้อสังเกตทั่วไป ไม่ใช่คำแนะนำทางกฎหมาย ให้ตรวจสอบระเบียบขององค์กรและปรึกษาฝ่ายกฎหมายของคุณเอง
และเพราะบทถอดเป็นผลจากการประมวลผลอัตโนมัติ จึงไม่มีการรับประกันในฐานะบันทึกทางกฎหมาย ให้เก็บไฟล์เสียงต้นฉบับคู่ไว้เสมอสำหรับเรื่องที่สำคัญ
เครื่องที่ใช้ได้ และค่าใช้จ่าย
Lesskeys ต้องใช้ macOS 13 ขึ้นไป และ Mac ชิป Apple Silicon (M1 ขึ้นไป) เท่านั้น เครื่อง Intel ใช้ไม่ได้ ตรวจได้จากเมนู Apple › เกี่ยวกับ Mac เครื่องนี้
ดาวน์โหลดฟรี จาก Mac App Store แล้วปลดล็อก Pro ในแอปด้วยการซื้อครั้งเดียว $49.99 ไม่ใช่รายเดือน (App Store ไทยแสดงราคาเป็นเงินบาทตามที่ Apple กำหนด) เวอร์ชันฟรีให้พิมพ์ด้วยเสียงวันละ 5 นาที และถอดไฟล์เสียง 5 ไฟล์กับวิดีโอ 5 ไฟล์ นับรวมตลอดอายุการใช้งาน ไม่ใช่ต่อวัน ส่วนการอัดเสียงเก็บไว้ไม่จำกัดจำนวน และการสั่งถอดซ้ำไฟล์ที่เคยถอดแล้วไม่กินโควตา ซึ่งพอสำหรับลองกับงานจริงของคุณก่อนตัดสินใจ
ดาวน์โหลดฟรี จ่ายครั้งเดียว ไม่ใช่รายเดือน · ปลดล็อก Pro $49.99 ครั้งเดียว (App Store ไทยแสดงราคาเป็นเงินบาท) · ต้องใช้ macOS 13 ขึ้นไป
คำถามที่พบบ่อย
ถอดไฟล์เสียงหนึ่งชั่วโมงใช้เวลานานแค่ไหน
ขึ้นกับรุ่นชิปของเครื่องและขนาดโมเดลที่เลือก เพราะการประมวลผลทั้งหมดเกิดบนเครื่องคุณ ไม่ใช่บนเซิร์ฟเวอร์ ระหว่างถอดไฟล์ยาวเครื่องจะอุ่นขึ้นและพัดลมอาจทำงาน แนะนำให้เสียบสายชาร์จไว้และปล่อยให้ทำงานไปโดยไม่ปิดฝา
ต้องแปลงไฟล์วิดีโอเป็นไฟล์เสียงก่อนไหม
ไม่ต้อง ลากไฟล์วิดีโอเข้ามาได้เลย แอปจะดึงเฉพาะเสียงออกมาถอดให้
ตั้งชื่อผู้พูดแล้วต้องตั้งใหม่ทุกไฟล์ไหม
ไม่ต้อง ลายเสียงที่ตั้งชื่อไว้จะถูกเก็บไว้ในเครื่องและนำมาใช้กับไฟล์ถัดไปได้ ทำให้การประชุมประจำหรือการสัมภาษณ์ชุดเดียวกันขึ้นชื่อคนถูกตั้งแต่ต้น ข้อมูลลายเสียงเก็บอยู่ในเครื่อง ไม่ได้ถูกส่งขึ้นเซิร์ฟเวอร์
ส่งออกเป็นไฟล์อะไรได้บ้าง
บทถอดส่งออกเป็น TXT ซับไตเติ้ลส่งออกเป็น SRT และ VTT ส่วนประวัติการถอดส่งออกเป็น TXT, JSON และ CSV หากต้องการเอกสารจัดรูปแบบ ให้ส่งออก TXT แล้ววางลงในโปรแกรมเอกสารที่คุณใช้
ผลภาษาไทยพร้อมใช้ทันทีเลยไหม
ควรถือว่าเป็นร่างแรก ภาษาไทยไม่มีช่องว่างระหว่างคำ การตัดคำและวรรคตอนจึงเป็นการตีความของเครื่อง และคำทับศัพท์กับชื่อเฉพาะมักเพี้ยน ให้เผื่อเวลาอ่านทวนและแก้ก่อนส่งงานเสมอ
ต้องต่ออินเทอร์เน็ตระหว่างถอดไหม
ไม่ต้อง ต้องต่อเน็ตเฉพาะตอนดาวน์โหลดแอปและโมเดลครั้งแรกเท่านั้น หลังจากนั้นถอดเสียงและแยกผู้พูดได้โดยไม่ต้องเชื่อมต่อ และไม่มีการอัปโหลดไฟล์ออกจากเครื่อง