**איך מתמללים ראיון: רמות תמלול וסימון**
Source: https://sozai.app/he/how-to-transcribe-an-interview/

[מדריכים](https://sozai.app/he/category/madrichim/)

# איך מתמללים ראיון: רמות תמלול, תוויות דוברים וסימון

אוק 2, 2026  • 2 min read • 13 views  • עודכן לאחרונה: אוק 2, 2026

![Two chairs facing each other at a small table by a window, a phone recording between them next to a notebook](https://sozai.app/wp-content/uploads/post-how-to-transcribe-an-interview-1280x720.webp)

> ### עיקרי הדברים
>
>
>
> לפני שמקלידים מילה אחת, מחליטים על רמת הדיוק לדיבור: תמלול מילה במילה מלא שומר על כל ״אממ״ ועל כל פתיחה שננטשה, תמלול נקי שומר על המשמעות בלי מילות המילוי, ותמלול ערוך מיישר את הדקדוק לנוחות הקריאה. בוחרים סימון להפסקות, לדיבור חופף ולקטעים לא ברורים, כותבים אותו כמקרא בראש המסמך ומסמנים את הדוברים באופן עקבי. בהקלדה ידנית, מדריך ההיסטוריה בעל פה של ספריות Texas Tech University קובע שש שעות הקלדה לכל שעת הקלטה, ומדריך קורס של Cornell University קובע ארבע עד שש. תמלול אוטומטי נותן טיוטה ראשונה תוך דקות; העבודה האנושית עוברת מהקלדה לבדיקת הטקסט מול ההקלטה.

יש לך את ההקלטה. עכשיו מישהו צריך תמלול שאפשר לצטט, לקודד או להגיש, והשאלה הראשונה היא לא באיזו אפליקציה להשתמש, אלא כמה מהדיבור אתם הולכים לשמור.

מילות מילוי והתחלות שנקטעו חשובות בניתוח שיחה ובהקשרים משפטיים מסוימים; בכל מקום אחר הן רעש. המאמר עובר על שלוש רמות הדיוק, על הסימון של הפסקות וחפיפות, על הזמן שהעבודה לוקחת ביד, ועל מה שתמלול אוטומטי עושה נכון ומה לא, על הקלטה אמיתית.

## מהי הדרך הקלה ביותר לתמלל ראיון?

מריצים קודם את ההקלטה במנוע דיבור-לטקסט, ואז מתקנים שמות, בודקים מדגמית מול האודיו ומוסיפים את הסימון שהפרויקט דורש — זה מהיר יותר מהקלדה מדף ריק, וזה מה שרוב האנשים מתכוונים אליו כשהם אומרים ״הכי קל״. להקליד שעה שלמה של דיבור מאפס, מילה במילה, זו הדרך האיטית, לא הקלה.

לקטע קצר, הכלי שלנו בדפדפן, [תמלול ראיון אונליין](https://sozai.app/he/tools/transcribe-interview/), עושה את המעבר הראשון הזה בלי חשבון: מעלים הקלטה והוא מתמלל את 5 הדקות הראשונות, מסמן כל תור דיבור כ־Speaker A, Speaker B וכן הלאה עם חותמת זמן, ומזהה את השפה אוטומטית מתוך 99 שפות. קבצים עד 25 MB עוברים כמות שהם; הקלטות ארוכות יותר נחתכות ל־5 דקות בתוך הדפדפן לפני ששולחים משהו. האודיו והתמלול נמחקים אצל הספק ברגע שהתוצאה חוזרת, ומותרות שלוש תצוגות מקדימות ביום למכשיר.

זה מספיק כדי לראות אם הכלי מתאים להקלטה מסוימת. לראיון שלם במעבר אחד, עם תורות דיבור מסומנים לכל אורכו וכל תמלול נשמר אחר כך בספרייה שאפשר לחפש בה, אפליקציית SozAI עושה זאת — 30 הדקות הראשונות חינם. אפשר לקרוא את התמונה המלאה ב [איך עובד תמלול ראיונות](https://sozai.app/he/interview-transcription/), או [להוריד את האפליקציה](https://sozai.app/he/download/).

## מה ההבדל בין תמלול מילה במילה לתמלול נקי?

תמלול מילה במילה מלא שומר על כל מילה כפי שנאמרה: ה״אממ״, ההתחלות שנקטעו, המילים החוזרות, הגמגום והצחוק שנשמע. תמלול נקי שומר על דברי הדובר ועל משמעותם אבל משמיט את מילות המילוי, את ההתחלות שנקטעו ואת החזרות הלא מכוונות. תמלול ערוך הולך צעד נוסף ומיישר דקדוק וסדר משפטים כך שיקרא היטב — וזו בדיוק הסיבה שהוא מפסיק להיות ראיה למה שנאמר בפועל.

- מילה במילה מלא: ניתוח שיחה, עבודה משפטית וראייתית מסוימת.
- נקי: רוב המחקר האיכותני, עיתונאות, מחקר משתמשים.
- ערוך: מאמרי שאלות ותשובות שמתפרסמים.

| רמה | מה היא שומרת | שימוש אופייני |
| --- | --- | --- |
| מילה במילה מלא | כל מילה כפי שנאמרה: מילות מילוי, התחלות שנקטעו, חזרות, גמגום, קולות שנשמעים | ניתוח שיחה, עבודה משפטית וראייתית מסוימת |
| נקי | דברי הדובר ומשמעותם, בלי מילות מילוי והתחלות שנקטעו | רוב המחקר האיכותני, עיתונאות, מחקר משתמשים |
| ערוך | דקדוק וסדר משפטים מיושרים לנוחות הקריאה | מאמרי שאלות ותשובות שמתפרסמים |

אם התמלול נכנס לפרויקט מחקר ולא ליצירה שתתפרסם, מחליטים על כך לפני הראיון הראשון, לא אחרי החמישי — מעבר בין רמות באמצע פירושו לעבד מחדש תמלולים קודמים כדי שיתאימו. הצד המחקרי, הסכמה, אנונימיזציה ואחסון, מכוסה ב [תמלול ראיונות למחקר](https://sozai.app/he/interview-transcript-for-research/).

## איך כותבים תמלול של ראיון?

מתחילים במקרא: רמת התמלול, הסמלים שבהם משתמשים, ואופן סימון הדוברים, כתובים בראש המסמך לפני שורת הדיבור הראשונה. מי שמקודד או מצטט את התמלול בהמשך צריך את המקרא הזה, וגם אתם תצטרכו אותו כעבור שבועות, כשכבר שכחתם מה (.) אמור היה להיות.

השיטה המוכרת ביותר לתמלולים מפורטים היא של Gail Jefferson, והיא מוצגת במאמרה [Glossary of transcript symbols with an introduction](https://doi.org/10.1075/pbns.125.02jef) (2004). כפי שמסכמים [Clift, Kendrick, Raymond ו־Robinson (2024)](https://eprints.whiterose.ac.uk/id/eprint/237652/1/Clift_Kendrick_Raymond_Robinson._2024_-_Jeffersonian_Transcription_conventions.pdf), סוגר מרובע שמאלי מסמן את הנקודה שבה מתחיל דיבור חופף, סימן שוויון מחבר דיבור בלי רווח ביניהם, מספר בסוגריים כמו (0.5) הוא שתיקה מדודה בשניות, ו־(.) מסמן הפסקה קצרה מכדי למדוד. המקורות חלוקים לגבי כמה קצרה מיקרו־הפסקה, ולכן אם המקרא שלכם משתמש ב־(.), עליו לומר למה הכוונה.

רוב פרויקטי הראיונות לא צריכים רמת פירוט כזו וקל יותר לקרוא אותם בלעדיה. מוסכמה פשוטה בסוגריים מרובעים מכסה את מה שבאמת צץ: [inaudible 00:12:31] לקטע שאי אפשר להבין, עם חותמת זמן כדי למצוא אותו שוב; [crosstalk] כששני אנשים מדברים זה מעל זה; [laughs] ואירועים לא מילוליים אחרים בסוגריים מרובעים; ותווית דובר בתחילת כל תור דיבור.

| סמל | משמעות | שיטה |
| --- | --- | --- |
| [ | הנקודה שבה מתחיל דיבור חופף | Jefferson |
| = | דיבור מחובר בלי רווח (latching) | Jefferson |
| (0.5) | שתיקה מדודה, בשניות | Jefferson |
| (.) | הפסקה קצרה מכדי למדוד | Jefferson |
| [inaudible 00:12:31] | קטע שאי אפשר להבין, עם חותמת זמן | סוגריים |
| [crosstalk] | שני אנשים מדברים בו־זמנית | סוגריים |
| [laughs] | צליל לא מילולי | סוגריים |

מעבר לסימון, [ההנחיות של UK Data Service לתמלול](https://dam.ukdataservice.ac.uk/media/187730/transcriptiondm25april2013.pdf) קובעות שתמלול צריך לשאת מזהה ייחודי, לעקוב אחר פריסה אחידה בכל הפרויקט, להשתמש בתגיות דוברים לסימון תורות דיבור ולשמור על מעברי שורה — דברים קטנים, אבל הם מה שמאפשר למצוא ולהשוות תמלולים בהמשך במקום לקרוא את כולם מחדש.

תוויות הדוברים הן שמות שתוכנת התמלול לא יכולה לדעת — צפו ל־Speaker A ול־Speaker B, ואותם משנים ידנית כשכבר יודעים מי הוא מי. [סימון עקבי של דוברים](https://sozai.app/he/who-said-what-transcript/) עובר על האופן לעשות זאת בכל פרויקט בלי שהשמות יסטו בין הקבצים.

עושים אנונימיזציה תוך כדי עבודה, לא אחריה: מחליפים שמות ופרטים מזהים בתחליפים עקביים כמו [Participant 2] או [city] ישירות בתמלול, ושומרים את המקרא שממפה תחליפים לשמות האמיתיים בקובץ נפרד. הקלטת אדם דורשת כמעט בכל מקום את הסכמתו, וועדת אתיקה של מחקר תדרוש בדרך כלל הסכמה בכתב; תמלול ההקלטה לא משנה את הדרישה הזו.

## כמה זמן לוקח לתמלל ראיון?

ביד, תכננו שעות, לא דקות. [מדריך ההיסטוריה בעל פה של ספריות Texas Tech University](https://guides.library.ttu.edu/c.php?g=1275281&p=9356352) קובע שגם מתמללים מנוסים עובדים בדרך כלל בקצב של שש שעות הקלדה לכל שעת אודיו. [מדריך קורס של Cornell University](https://courses2.cit.cornell.edu/fit117/CP_T.htm) מציב אותו נמוך יותר, ארבע עד שש שעות לשעת הקלטה — ההפרש נובע בעיקר מניקיון האודיו וממידת הסימון שנוסף בדרך.

תמלול אוטומטי משנה לאן הזמן הולך, ולא גורם לו להיעלם. הטיוטה חוזרת תוך דקות; מה שנשאר הוא להאזין לה מול ההקלטה, לתקן שמות ומונחים מקצועיים, לתקן מי אמר מה במקומות שבהם התוויות התבלבלו, ולהוסיף את הסימון שהפרויקט דורש. בראיון של שעה זו עדיין עבודה של ממש, רק מסוג אחר — [כמה זמן תמלול באמת לוקח](https://sozai.app/he/how-long-will-transcription-take/) מפרט זאת יותר.

## האם ChatGPT יכול לתמלל ראיון?

האם צ׳אטבוט יכול להפוך קובץ אודיו לטקסט תלוי במוצר, אבל תמלול ראיון צריך יותר מטקסט: חותמות זמן שאפשר לחזור אליהן ותורות דיבור שאפשר לסמוך עליהם, וזה מה שמנוע תמלול נבנה לייצר. המקום שבו צ׳אטבוט מרוויח את מקומו הוא אחרי השלב הזה, בסידור, בסיכום או בעיצוב מחדש של תמלול שכבר יש לכם.

בכל מקרה, טקסט אוטומטי חייבים לבדוק מול ההקלטה לפני שמצטטים אותו, והבדיקה הזו היא החלק שאף כלי לא מסיר.

כמה בדיקה מנוע מסוים דורש משתנה לא מעט. [עד כמה מדויק תמלול בינה מלאכותית](https://sozai.app/he/how-accurate-is-ai-transcription/) מכסה למה לצפות ואיפה השגיאות נוטות להתקבץ.

## במה תמלול אוטומטי אמיתי טועה

תמלול אוטומטי הוא טיוטה, והדרך הברורה ביותר להבין מה זה אומר היא להריץ אחד ולקרוא אותו מול ההקלטה. ב־2 באוקטובר 2026 עשינו בדיוק את זה, על 5 הדקות הראשונות של הקלטה ציבורית שכל אחד יכול לבדוק מול המאמר הזה.

הרצנו את המנוע שמאחורי כלי הראיונות של SozAI על 5 הדקות הראשונות (300 שניות) של הפודקאסט של NASA Johnson Space Center בשם Houston We Have a Podcast, פרק 180, ״Artemis Mission Management״, המנחה Gary Jordan והאורח Mike Sarafin — יצירה של NASA, ולכן לא מוגנת בזכויות יוצרים. התוצאה חזרה עם 778 מילים, זוהתה אנגלית, ונמצאו 2 דוברים. השורות הראשונות, כפי שהמנוע הציג אותן:

[00:00] Speaker A: Houston, we have a podcast. Welcome to the official podcast of the NASA Johnson Space Center, episode 180, Artemis Mission Management. I'm Gary Jordan, and I'll be your host today.
[01:19] Speaker B: T-minus five seconds and counting. Mark.
[01:22] Speaker A: Launch commit lights are correct. There she goes. Houston. We have a podcast. Mike Serafin, thanks for coming on Houston, We Have a Podcast today.
[01:36] Speaker B: Thank you. It's a pleasure to be here to talk about these exciting Artemis missions we have ahead of us. Yeah, right?
[01:43] Speaker A: Returning to the Moon. Not a bad thing to be a part of.

שלושה דברים בחמשת התורות האלה בלבד דרשו מעבר אנושי. ספירת השיגור ב־01:19 וה־״Launch commit lights are correct. There she goes.״ ב־01:22 הם אודיו ארכיוני משיגור ששולב בפודקאסט, לא המנחה ולא האורח מדברים — המנוע תייג אותם בכל זאת כ־Speaker B וכ־Speaker A. ה־״Yeah, right?״ בסוף התור של 01:36 הוא בעצם המנחה שחוזר לשיחה; הוא שייך לתחילת התור הבא, לא לסוף התור של האורח. ושם המשפחה של האורח יוצא כאן Serafin, אף שקרדיטי הפרק עצמם כותבים Sarafin.

תור מאוחר יותר מראה למה משמש תמלול נקי. הפלט של המנוע ב־02:51 הוא: ״Yes, so you're, you're right in that I lived in the operations realm for 22 of my 27 years in, in my NASA career.״ מעבר ניקוי הופך אותו ל: ״You're right in that I lived in the operations realm for 22 of my 27 years in my NASA career.״ תמלול מילה במילה מלא היה שומר את החזרות בדיוק כפי שיצאו; המנוע, אם כבר, נוטה לשמור אותן — הוא השאיר את רוב החזרות וההתחלות שנקטעו לאורך הקובץ (״you're, you're right״, ״in, in my NASA career״, ״That's, that's quite a number of״), מה שמקרב את הפלט שלו לתמלול מילה במילה יותר מאשר לתמלול נקי. אם פרויקט דורש תמלול נקי, תקצבו מעבר עריכה בלי קשר לאיזה מנוע הפיק את הטיוטה.

תשובות

## Frequently Asked Questions

מהי הדרך הקלה ביותר לתמלל ראיון?

מריצים את ההקלטה במנוע דיבור-לטקסט לקבלת טיוטה ראשונה, ואז בודקים אותה מול האודיו ומתקנים שמות דוברים ומילים לא ברורות — להקליד מאפס ביד זה איטי יותר, לא קל יותר. כלי בדפדפן כמו מתמלל הראיונות של SozAI יכול להפיק טיוטה מסומנת ועם חותמות זמן של 5 הדקות הראשונות בלי חשבון, וזה מספיק כדי לשפוט אם כדאי להריץ את הקובץ כולו.

איך נראה תמלול ראיון גמור?

הוא נפתח במקרא קצר שמציין את רמת התמלול, את הסימון שבו משתמשים ואת אופן סימון הדוברים, ואחריו תורות דיבור מסומנים כמו Speaker A, עם חותמות זמן. ההנחיות של UK Data Service לתמלול מוסיפות שהוא צריך לשאת מזהה ייחודי, פריסה אחידה, תגיות דוברים ומעברי שורה, כדי שאפשר יהיה למצוא ולהשוות אותו בהמשך ולא לקרוא אותו מחדש.

האם ChatGPT יכול לתמלל ראיון?

זה תלוי במוצר, והוא הכלי הלא נכון לצעד הראשון. תמלול ראיון צריך חותמות זמן ותורות דיבור שאפשר לסמוך עליהם, וזה מה שמנוע תמלול מפיק. צ׳אטבוט שימושי אחר כך, לסידור, לסיכום או לעיצוב מחדש של תמלול שכבר יש לכם, וכל טקסט אוטומטי עדיין חייבים לבדוק מול ההקלטה.

לבחור תמלול מילה במילה או נקי?

משתמשים במילה במילה מלא לניתוח שיחה או לעבודה משפטית וראייתית, שבהם כל ״אממ״, התחלה שנקטעה וחזרה חשובים; משתמשים בנקי לרוב המחקר האיכותני, העיתונאות ומחקר המשתמשים, שבהם המשמעות חשובה יותר מההיסוסים. מחליטים לפני הראיון הראשון, כי מעבר באמצע פירושו לעבד מחדש תמלולים קודמים.

איך מסמנים קטעים לא ברורים בתמלול?

כותבים [inaudible] עם חותמת זמן, כמו [inaudible 00:12:31], כדי שאתם או כל אחד אחר יוכלו למצוא את המקום בהקלטה שוב בהמשך. לדיבור חופף משתמשים ב־[crosstalk], ולצלילים לא מילוליים כמו צחוק ב־[laughs] — הכול בסוגריים מרובעים, ומוסבר פעם אחת במקרא בראש התמלול.

כמה זמן לוקח לתמלל ראיון של שעה?

ביד, מדריך ההיסטוריה בעל פה של ספריות Texas Tech University קובע בערך שש שעות הקלדה לכל שעת אודיו; מדריך קורס של Cornell University מעריך ארבע עד שש שעות. תמלול אוטומטי מחזיר טיוטה תוך דקות, והזמן שנשאר עובר לבדיקה מול ההקלטה במקום להקלדה.

![Merey Tleugazin](https://sozai.app/wp-content/themes/sozai/assets/images/merey-tleugazin.webp)

[Merey Tleugazin](https://sozai.app/about/merey/)

מייסד SozAI. בונה כלים שהופכים דיבור לטקסט עבור אנשי מקצוע ברחבי העולם.

- [Instagram](https://instagram.com/mereytleugazin)
- [X](https://x.com/mereytleugazin)

## מאמרים קשורים

- [מרץ 18 2 min ### איך להמיר הודעות קוליות לטקסט: שיטות חינמיות ל-iPhone ו-Android](https://sozai.app/he/voicemail-to-text/)
- [אוג 2 1 min ### איך לחלץ טקסט מקובץ וידאו במק](https://sozai.app/he/text-out-of-a-video-on-a-mac/)
- [אוג 2 1 min ### איך הופכים פרק פודקאסט להערות פרק שאנשים באמת קוראים](https://sozai.app/he/podcast-episode-into-show-notes/)

[![SozAI](https://sozai.app/wp-content/themes/sozai/assets/images/appicon.png) SozAI — הורדה בחינם תמללו אודיו ווידאו מיידית הורדת האפליקציה](https://sozai.app/he/download/)


---
This is the markdown twin of https://sozai.app/he/how-to-transcribe-an-interview/ — the same content, without the markup.
Published by SozAI (https://sozai.app). Reuse and quotation are allowed with attribution and a link back.
Machine-readable index: https://sozai.app/llms.txt · data API: https://sozai.app/api/
