ข้ามไปยังเนื้อหา

ทดลองฟรี

ถอดเทปสัมภาษณ์ออนไลน์

วางไฟล์บันทึกเสียงสัมภาษณ์ แล้วรับ 5 นาทีแรกเป็นข้อความ พร้อมแยกป้ายกำกับผู้สัมภาษณ์กับผู้ให้สัมภาษณ์ ไม่ต้องมีบัญชี ตรวจจับภาษาอัตโนมัติ และลบไฟล์ทิ้งหลังประมวลผลเสร็จ

  • ดูตัวอย่างฟรี: 5 นาทีแรก
  • ลบทิ้งหลังประมวลผล
  • ไม่ต้องสมัครสมาชิก

วางไฟล์บันทึกการสัมภาษณ์ที่นี่

หรือ

รองรับไฟล์ MP3, M4A, WAV, OGG/OPUS, AAC, FLAC และ WEBM

วิธีการทำงาน

ถอดเทปสัมภาษณ์ออนไลน์ ใน 3 ขั้นตอน

01

วางไฟล์เสียงสัมภาษณ์

ไฟล์จากมือถือ เสียงที่ส่งออกจาก Zoom หรือเครื่องอัดเสียง เบราว์เซอร์เก็บไว้ 5 นาทีแรก

02

ระบบแยกผู้พูดให้

ผู้สัมภาษณ์และผู้ให้สัมภาษณ์ได้ป้ายกำกับแยกกันพร้อมเวลา ตรวจจับภาษาอัตโนมัติ

03

คัดลอกไปวิเคราะห์ต่อ

ดาวน์โหลดเป็น TXT หรือคัดลอกข้อความ ส่วนบทสัมภาษณ์เต็มทำต่อในแอป

จากไฟล์เสียงสู่ข้อความที่ยกไปอ้างได้

ไม่ว่าจะเป็นการสัมภาษณ์เพื่อทำวิทยานิพนธ์ การสัมภาษณ์แหล่งข่าวสำหรับบทความ หรือการสัมภาษณ์ผู้ใช้เพื่อพัฒนาผลิตภัณฑ์ ไฟล์เสียงจะเริ่มมีประโยชน์ก็ต่อเมื่อกลายเป็นข้อความ ที่ลงรหัสได้ ยกมาอ้างได้ และค้นหาได้ การถอดด้วยมือกินเวลาสี่ถึงหกชั่วโมงต่อเสียงหนึ่งชั่วโมง หน้านี้ให้คุณเห็นว่าเวอร์ชันอัตโนมัติทำงานกับไฟล์ของคุณเองออกมาเป็นอย่างไร โดยใช้ 5 นาทีแรก ก่อนจะตัดสินใจส่งส่วนที่เหลือเข้าแอป

ใครพูดอะไร

บทสัมภาษณ์คือเสียงสองคน และข้อความที่ได้ก็สะท้อนแบบนั้น แต่ละช่วงการพูดจะมีป้ายกำกับ Speaker A หรือ Speaker B พร้อมเวลากำกับ คำถามของผู้สัมภาษณ์กับคำตอบของผู้ให้สัมภาษณ์จึงไม่ปนกัน วงสนทนาสามคนก็ทำงานแบบเดียวกัน ป้ายกำกับคงเส้นคงวาตลอดทั้งฉบับ คนที่เป็น Speaker B ในนาทีแรกก็ยังเป็น Speaker B ในนาทีที่สี่ ซึ่งเป็นเงื่อนไขที่ทำให้ลงรหัสแยกรายผู้ให้สัมภาษณ์ได้

ตัวอย่างนี้ทำงานอย่างไร

เบราว์เซอร์อ่านไฟล์และเก็บไว้แค่ 5 นาทีแรก ไฟล์ที่ยาวกว่านั้นจะถูกตัดในเครื่องคุณเอง แล้วเข้ารหัสส่วนนั้นใหม่เป็น WAV แบบโมโน 16 kHz ส่วนที่เหลือจึงไม่เคยถูกอัปโหลดเลย เสียงถูกส่งผ่านการเชื่อมต่อที่เข้ารหัสไปยังเอนจินถอดความที่อยู่เบื้องหลังแอป SozAI (AssemblyAI) ระบบตรวจจับภาษาอัตโนมัติจาก 99 ภาษา เติมเครื่องหมายวรรคตอน และเก็บกวาดคำเสริมออกเล็กน้อย ผลลัพธ์จึงเป็นข้อความที่อ่านลื่น ไม่ใช่การถอดแบบคำต่อคำเป๊ะ ๆ เมื่อส่งข้อความกลับมาแล้ว ทั้งไฟล์เสียงและข้อความจะถูกลบทิ้งที่ฝั่งผู้ให้บริการ

รูปแบบไฟล์และข้อจำกัด

  • M4A, MP3, WAV, AAC, FLAC, OGG/OPUS, WEBM ขนาดไม่เกิน 25 MB ส่งได้ตามเดิม ไฟล์ที่ยาวกว่านั้นจะถูกตัดเหลือ 5 นาทีในเบราว์เซอร์ก่อน (ไม่เกิน 30 MB บนคอมพิวเตอร์ และ 12 MB บนมือถือ)
  • ทดลองได้สามครั้งต่อหนึ่งอุปกรณ์ต่อวัน ไม่ต้องมีบัญชี
  • สายโทรศัพท์ที่อัดผ่านลำโพง และการสัมภาษณ์บนโต๊ะในร้านกาแฟ ถอดได้ทั้งคู่ แต่จะมีข้อผิดพลาดมากขึ้นกับเสียงที่เบากว่า

ความยินยอมและการรักษาความลับ

การบันทึกเสียงบุคคลต้องได้รับความยินยอมจากเจ้าตัวแทบทุกที่ และคณะกรรมการจริยธรรมการวิจัยมักกำหนดให้ต้องเป็นลายลักษณ์อักษร การนำไปถอดความไม่ได้เปลี่ยนข้อกำหนดนั้น หากระเบียบวิธีวิจัยของคุณจำกัดว่าเสียงจะถูกประมวลผลที่ใดได้บ้าง โปรดทราบว่าตัวอย่างนี้ประมวลผลโดยผู้ให้บริการในสหรัฐอเมริกา เว้นแต่เว็บไซต์จะถูกตั้งค่าให้ใช้ปลายทางในสหภาพยุโรป และสำหรับงานที่อยู่ภายใต้ข้อตกลงด้านข้อมูล ให้ใช้การตั้งค่าโปรเจกต์ในแอปแทน

บทสัมภาษณ์ทั้งไฟล์

การสัมภาษณ์หนึ่งชั่วโมงเท่ากับเสียงสิบสองตัวอย่างรวมกัน แอป SozAI ถอดให้จบในรอบเดียว คงป้ายกำกับผู้พูดไว้ สรุปประเด็นหลักให้ และเก็บทุกบทสัมภาษณ์ไว้ในคลังที่ค้นข้ามไฟล์ได้ นำเข้าจาก Voice Memos, Files หรือไฟล์บันทึกที่มีคนแชร์มาก็ได้ 30 นาทีแรกใช้ฟรี

คำตอบ

ถอดเทปสัมภาษณ์ — คำถามที่พบบ่อย

ระบบบอกได้ไหมว่าใครกำลังพูด

ได้ แต่ละช่วงการพูดจะมีป้ายกำกับ Speaker A, Speaker B ไล่ไปเรื่อย ๆ พร้อมเวลากำกับ และป้ายจะคงเส้นคงวาตลอดทั้งฉบับ ระบบไม่เดาชื่อจริง คุณเปลี่ยนชื่อป้ายเองได้ในเอกสารของคุณหรือในแอป

ข้อความที่ได้เป็นแบบคำต่อคำหรือเปล่า

เป็นแบบอ่านสะอาด คือเติมเครื่องหมายวรรคตอนและตัดคำเสริมที่เห็นชัดออก เพื่อให้อ่านได้เป็นธรรมชาติ ถ้าระเบียบวิธีของคุณต้องการทุกเสียงเอ่อ อ้า และทุกการพูดสะดุด ให้ระบุไว้ในโปรโตคอลและเผื่อเวลาฟังย้อนเพื่อใส่กลับเข้าไปบางส่วน

รองรับภาษาอะไรบ้าง

ระบบตรวจจับภาษาให้อัตโนมัติจาก 99 ภาษา บทสัมภาษณ์ที่ดำเนินเป็นภาษาหนึ่งแต่มีคำจากอีกภาษาแทรกเป็นครั้งคราว จะถูกถอดเป็นภาษาหลักที่ใช้

ทดลองกับไฟล์ยาวแค่ไหนได้

ยาวเท่าไรก็ได้ แต่คุณจะได้ 5 นาทีแรก ไฟล์ไม่เกิน 25 MB ส่งไปทั้งไฟล์ ส่วนไฟล์ที่ยาวกว่านั้นจะถูกตัดเหลือ 5 นาทีในเบราว์เซอร์ของคุณก่อน (ไม่เกิน 30 MB บนคอมพิวเตอร์ และ 12 MB บนมือถือ)

เสียงถูกประมวลผลที่ไหน และเก็บไว้ไหม

ส่งผ่านการเชื่อมต่อที่เข้ารหัสไปยังผู้ให้บริการถอดความ (AssemblyAI ภูมิภาคสหรัฐอเมริกา เว้นแต่จะเปิดใช้ปลายทางสหภาพยุโรป) ถอดเป็นข้อความ แล้วลบทั้งไฟล์เสียงและข้อความทิ้งที่นั่นเมื่อส่งผลลัพธ์กลับมาแล้ว เว็บไซต์นี้ไม่เก็บทั้งสองอย่าง

ใช้กับงานที่ผ่านจริยธรรมการวิจัยได้ไหม

ขึ้นอยู่กับกฎของคณะกรรมการของคุณเรื่องการประมวลผลโดยบุคคลที่สาม ตัวอย่างนี้มีไว้ให้ลองเช็กไฟล์ของคุณเองอย่างรวดเร็ว สำหรับบทสัมภาษณ์ที่อยู่ภายใต้ข้อตกลงด้านข้อมูล ให้อ่านหน้าความปลอดภัยของ SozAI แล้วใช้งานผ่านแอป ซึ่งไฟล์เต็มจะถูกจัดการอยู่ภายใต้บัญชีเดียว

ถอดสายโทรศัพท์หรือการประชุม Zoom ที่อัดไว้ได้ไหม

ได้ ขอแค่มีไฟล์เสียง Zoom และ Teams บันทึกแบบเสียงอย่างเดียวได้ (.m4a) ส่วนแอปอัดสายโทรศัพท์มักได้ไฟล์ MP3 หรือ M4A เสียงสองคนที่อยู่ในช่องสัญญาณเดียวกันก็ยังแยกออกจากกันได้

แม่นยำแค่ไหน

ถ้าอัดในที่เงียบและไมค์อยู่ใกล้ ข้อความที่ได้จะใกล้เคียงคำต่อคำ ส่วนมือถือที่วางบนโต๊ะร้านกาแฟระหว่างคนสองคน มักตกคำไปบ้างจากฝั่งที่เสียงเบากว่า ป้ายกำกับผู้พูดจะแม่นที่สุดเมื่อน้ำเสียงของแต่ละคนต่างกันชัดเจน

ถอดเสียงทั้งไฟล์ ไม่ใช่แค่นาทีแรกๆ

บันทึกหรือนำเข้าไฟล์ความยาวเท่าไหร่ก็ได้ในแอป: ป้ายชื่อผู้พูด ไทม์สแตมป์ สรุป และแปลได้กว่า 100+ ภาษา

ดาวน์โหลดแอป — ฟรี

ใช้ฟรีบน iOS และ Android รวมเวลาถอดเสียง 30 นาที ไม่ต้องใช้บัตร