ทดลองฟรี
ถอดเทปสัมภาษณ์ออนไลน์
วางไฟล์บันทึกเสียงสัมภาษณ์ แล้วรับ 5 นาทีแรกเป็นข้อความ พร้อมแยกป้ายกำกับผู้สัมภาษณ์กับผู้ให้สัมภาษณ์ ไม่ต้องมีบัญชี ตรวจจับภาษาอัตโนมัติ และลบไฟล์ทิ้งหลังประมวลผลเสร็จ
- ดูตัวอย่างฟรี: 5 นาทีแรก
- ลบทิ้งหลังประมวลผล
- ไม่ต้องสมัครสมาชิก
วางไฟล์บันทึกการสัมภาษณ์ที่นี่
หรือ
รองรับไฟล์ MP3, M4A, WAV, OGG/OPUS, AAC, FLAC และ WEBM
เพิ่มไฟล์ SRT (2+)
บทถอดเสียง
วิธีการทำงาน
ถอดเทปสัมภาษณ์ออนไลน์ ใน 3 ขั้นตอน
วางไฟล์เสียงสัมภาษณ์
ไฟล์จากมือถือ เสียงที่ส่งออกจาก Zoom หรือเครื่องอัดเสียง เบราว์เซอร์เก็บไว้ 5 นาทีแรก
ระบบแยกผู้พูดให้
ผู้สัมภาษณ์และผู้ให้สัมภาษณ์ได้ป้ายกำกับแยกกันพร้อมเวลา ตรวจจับภาษาอัตโนมัติ
คัดลอกไปวิเคราะห์ต่อ
ดาวน์โหลดเป็น TXT หรือคัดลอกข้อความ ส่วนบทสัมภาษณ์เต็มทำต่อในแอป
จากไฟล์เสียงสู่ข้อความที่ยกไปอ้างได้
ไม่ว่าจะเป็นการสัมภาษณ์เพื่อทำวิทยานิพนธ์ การสัมภาษณ์แหล่งข่าวสำหรับบทความ หรือการสัมภาษณ์ผู้ใช้เพื่อพัฒนาผลิตภัณฑ์ ไฟล์เสียงจะเริ่มมีประโยชน์ก็ต่อเมื่อกลายเป็นข้อความ ที่ลงรหัสได้ ยกมาอ้างได้ และค้นหาได้ การถอดด้วยมือกินเวลาสี่ถึงหกชั่วโมงต่อเสียงหนึ่งชั่วโมง หน้านี้ให้คุณเห็นว่าเวอร์ชันอัตโนมัติทำงานกับไฟล์ของคุณเองออกมาเป็นอย่างไร โดยใช้ 5 นาทีแรก ก่อนจะตัดสินใจส่งส่วนที่เหลือเข้าแอป
ใครพูดอะไร
บทสัมภาษณ์คือเสียงสองคน และข้อความที่ได้ก็สะท้อนแบบนั้น แต่ละช่วงการพูดจะมีป้ายกำกับ Speaker A หรือ Speaker B พร้อมเวลากำกับ คำถามของผู้สัมภาษณ์กับคำตอบของผู้ให้สัมภาษณ์จึงไม่ปนกัน วงสนทนาสามคนก็ทำงานแบบเดียวกัน ป้ายกำกับคงเส้นคงวาตลอดทั้งฉบับ คนที่เป็น Speaker B ในนาทีแรกก็ยังเป็น Speaker B ในนาทีที่สี่ ซึ่งเป็นเงื่อนไขที่ทำให้ลงรหัสแยกรายผู้ให้สัมภาษณ์ได้
ตัวอย่างนี้ทำงานอย่างไร
เบราว์เซอร์อ่านไฟล์และเก็บไว้แค่ 5 นาทีแรก ไฟล์ที่ยาวกว่านั้นจะถูกตัดในเครื่องคุณเอง แล้วเข้ารหัสส่วนนั้นใหม่เป็น WAV แบบโมโน 16 kHz ส่วนที่เหลือจึงไม่เคยถูกอัปโหลดเลย เสียงถูกส่งผ่านการเชื่อมต่อที่เข้ารหัสไปยังเอนจินถอดความที่อยู่เบื้องหลังแอป SozAI (AssemblyAI) ระบบตรวจจับภาษาอัตโนมัติจาก 99 ภาษา เติมเครื่องหมายวรรคตอน และเก็บกวาดคำเสริมออกเล็กน้อย ผลลัพธ์จึงเป็นข้อความที่อ่านลื่น ไม่ใช่การถอดแบบคำต่อคำเป๊ะ ๆ เมื่อส่งข้อความกลับมาแล้ว ทั้งไฟล์เสียงและข้อความจะถูกลบทิ้งที่ฝั่งผู้ให้บริการ
รูปแบบไฟล์และข้อจำกัด
- M4A, MP3, WAV, AAC, FLAC, OGG/OPUS, WEBM ขนาดไม่เกิน 25 MB ส่งได้ตามเดิม ไฟล์ที่ยาวกว่านั้นจะถูกตัดเหลือ 5 นาทีในเบราว์เซอร์ก่อน (ไม่เกิน 30 MB บนคอมพิวเตอร์ และ 12 MB บนมือถือ)
- ทดลองได้สามครั้งต่อหนึ่งอุปกรณ์ต่อวัน ไม่ต้องมีบัญชี
- สายโทรศัพท์ที่อัดผ่านลำโพง และการสัมภาษณ์บนโต๊ะในร้านกาแฟ ถอดได้ทั้งคู่ แต่จะมีข้อผิดพลาดมากขึ้นกับเสียงที่เบากว่า
ความยินยอมและการรักษาความลับ
การบันทึกเสียงบุคคลต้องได้รับความยินยอมจากเจ้าตัวแทบทุกที่ และคณะกรรมการจริยธรรมการวิจัยมักกำหนดให้ต้องเป็นลายลักษณ์อักษร การนำไปถอดความไม่ได้เปลี่ยนข้อกำหนดนั้น หากระเบียบวิธีวิจัยของคุณจำกัดว่าเสียงจะถูกประมวลผลที่ใดได้บ้าง โปรดทราบว่าตัวอย่างนี้ประมวลผลโดยผู้ให้บริการในสหรัฐอเมริกา เว้นแต่เว็บไซต์จะถูกตั้งค่าให้ใช้ปลายทางในสหภาพยุโรป และสำหรับงานที่อยู่ภายใต้ข้อตกลงด้านข้อมูล ให้ใช้การตั้งค่าโปรเจกต์ในแอปแทน
บทสัมภาษณ์ทั้งไฟล์
การสัมภาษณ์หนึ่งชั่วโมงเท่ากับเสียงสิบสองตัวอย่างรวมกัน แอป SozAI ถอดให้จบในรอบเดียว คงป้ายกำกับผู้พูดไว้ สรุปประเด็นหลักให้ และเก็บทุกบทสัมภาษณ์ไว้ในคลังที่ค้นข้ามไฟล์ได้ นำเข้าจาก Voice Memos, Files หรือไฟล์บันทึกที่มีคนแชร์มาก็ได้ 30 นาทีแรกใช้ฟรี
คำตอบ
ถอดเทปสัมภาษณ์ — คำถามที่พบบ่อย
ระบบบอกได้ไหมว่าใครกำลังพูด
ได้ แต่ละช่วงการพูดจะมีป้ายกำกับ Speaker A, Speaker B ไล่ไปเรื่อย ๆ พร้อมเวลากำกับ และป้ายจะคงเส้นคงวาตลอดทั้งฉบับ ระบบไม่เดาชื่อจริง คุณเปลี่ยนชื่อป้ายเองได้ในเอกสารของคุณหรือในแอป
ข้อความที่ได้เป็นแบบคำต่อคำหรือเปล่า
เป็นแบบอ่านสะอาด คือเติมเครื่องหมายวรรคตอนและตัดคำเสริมที่เห็นชัดออก เพื่อให้อ่านได้เป็นธรรมชาติ ถ้าระเบียบวิธีของคุณต้องการทุกเสียงเอ่อ อ้า และทุกการพูดสะดุด ให้ระบุไว้ในโปรโตคอลและเผื่อเวลาฟังย้อนเพื่อใส่กลับเข้าไปบางส่วน
รองรับภาษาอะไรบ้าง
ระบบตรวจจับภาษาให้อัตโนมัติจาก 99 ภาษา บทสัมภาษณ์ที่ดำเนินเป็นภาษาหนึ่งแต่มีคำจากอีกภาษาแทรกเป็นครั้งคราว จะถูกถอดเป็นภาษาหลักที่ใช้
ทดลองกับไฟล์ยาวแค่ไหนได้
ยาวเท่าไรก็ได้ แต่คุณจะได้ 5 นาทีแรก ไฟล์ไม่เกิน 25 MB ส่งไปทั้งไฟล์ ส่วนไฟล์ที่ยาวกว่านั้นจะถูกตัดเหลือ 5 นาทีในเบราว์เซอร์ของคุณก่อน (ไม่เกิน 30 MB บนคอมพิวเตอร์ และ 12 MB บนมือถือ)
เสียงถูกประมวลผลที่ไหน และเก็บไว้ไหม
ส่งผ่านการเชื่อมต่อที่เข้ารหัสไปยังผู้ให้บริการถอดความ (AssemblyAI ภูมิภาคสหรัฐอเมริกา เว้นแต่จะเปิดใช้ปลายทางสหภาพยุโรป) ถอดเป็นข้อความ แล้วลบทั้งไฟล์เสียงและข้อความทิ้งที่นั่นเมื่อส่งผลลัพธ์กลับมาแล้ว เว็บไซต์นี้ไม่เก็บทั้งสองอย่าง
ใช้กับงานที่ผ่านจริยธรรมการวิจัยได้ไหม
ขึ้นอยู่กับกฎของคณะกรรมการของคุณเรื่องการประมวลผลโดยบุคคลที่สาม ตัวอย่างนี้มีไว้ให้ลองเช็กไฟล์ของคุณเองอย่างรวดเร็ว สำหรับบทสัมภาษณ์ที่อยู่ภายใต้ข้อตกลงด้านข้อมูล ให้อ่านหน้าความปลอดภัยของ SozAI แล้วใช้งานผ่านแอป ซึ่งไฟล์เต็มจะถูกจัดการอยู่ภายใต้บัญชีเดียว
ถอดสายโทรศัพท์หรือการประชุม Zoom ที่อัดไว้ได้ไหม
ได้ ขอแค่มีไฟล์เสียง Zoom และ Teams บันทึกแบบเสียงอย่างเดียวได้ (.m4a) ส่วนแอปอัดสายโทรศัพท์มักได้ไฟล์ MP3 หรือ M4A เสียงสองคนที่อยู่ในช่องสัญญาณเดียวกันก็ยังแยกออกจากกันได้
แม่นยำแค่ไหน
ถ้าอัดในที่เงียบและไมค์อยู่ใกล้ ข้อความที่ได้จะใกล้เคียงคำต่อคำ ส่วนมือถือที่วางบนโต๊ะร้านกาแฟระหว่างคนสองคน มักตกคำไปบ้างจากฝั่งที่เสียงเบากว่า ป้ายกำกับผู้พูดจะแม่นที่สุดเมื่อน้ำเสียงของแต่ละคนต่างกันชัดเจน
ถอดเสียงทั้งไฟล์ ไม่ใช่แค่นาทีแรกๆ
บันทึกหรือนำเข้าไฟล์ความยาวเท่าไหร่ก็ได้ในแอป: ป้ายชื่อผู้พูด ไทม์สแตมป์ สรุป และแปลได้กว่า 100+ ภาษา
ใช้ฟรีบน iOS และ Android รวมเวลาถอดเสียง 30 นาที ไม่ต้องใช้บัตร
เครื่องมือฟรี
เครื่องมือฟรีเพิ่มเติม
YouTube Transcript Generator · SozAI vs Other Tools · Alternatives to Popular Apps