インタビューを正しく文字起こしする方法:ステップバイステップガイド
インタビューを正しく文字起こしする方法のステップバイステップガイド。同意、録音セットアップ、逐語化のスタイル選択、フォーマット、実例、優れた文字起こしを台無しにする間違いをカバーしています。
インタビューの文字起こし方法がなぜ重要なのか
乱雑なインタビュー文字起こしはあなたに二重の代償をもたらします。引用文を確認するために記録を再度聞く必要があるときと、情報源、チームメイト、またはアドバイザーが簡単に見つけられない詳細を説明するよう求めてくるときです。インタビューが質的研究調査、プロダクトチームのユーザーインタビュー、ニュース記事、または授業の課題であろうと、文字起こしは通常、実際の音声ファイルではなく、実際に機能するドキュメントです。人々はテキストを読み、検索し、引用をコピーし、引用します。
だからこそ、プロセスは最終的な表現と同じくらい重要です。スピーカーラベルのない文字起こしでは、ステートメントを正しく属性化するのが難しくなります。タイムスタンプのない文字起こしでは、公開または提出する前に、引用文を記録に対して検証するのに時間がかかります。そして、誰かが言ったことを静かに「クリーンアップ」し、ヘッジ、繰り返し、または文の途中での心変わりを削除する文字起こしは、後で指摘されるまで誰も気づかないうちに答えの意味を変える可能性があります。急いで作成した文字起こしを修正するのではなく、最初のプロセスを正しく取得することが、使用可能なインタビューデータと責任の負債を区別するものです。これは、5人の質的研究と同じくらい、1つの市場調査顧客呼び出しに適用されます。
コンテキストによって賭け金は若干異なりますが、基本的な規律は異なりません。15のインタビューをコーディングしている質的研究者には、すべての文字起こしで一貫したフォーマットが必要です。そうしないと、コーディングが崩れます。1週間に5つのユーザーインタビューを実施しているプロダクトチームは、次のスプリントの前に決定を知らせるのに十分な速さで文字起こしが必要で、参加者が問題を説明するために使用した特定の表現を失うことなく。ジャーナリストは正確で防御可能な引用が必要です。直接引用として属性される言い換えは後で修正になる可能性があるためです。クラスプロジェクトの情報源インタビューを文字起こししている学生は通常、引用するのに十分な精度で何かを提出する必要があるだけですが、同じショートカット、不明なオーディオでの推測、またはスピーカーラベルをスキップすると、より小さなスケールで同じ問題が発生します。
文字起こしは通常、音声ファイルではなく、人々が実際に取り組むドキュメントです。プロセスを間違えると、そこから引き出されたすべての引用文がエラーを継承します。
インタビューを文字起こしする前に何が必要ですか?
良い文字起こしは、記録ボタンを押す前に始まります。事前に行われた4つの決定は、その後に選択するツール以上に時間を節約します。
最初に、記録と文字起こしがどのように使用されるかについて具体的な同意を得ます。学術論文、公開記事、または内部プロダクトノートかどうか。研究者はAPA Styleガイダンスをチェックして、引用されたインタビュー資料を論文でどのようにフォーマットするかを確認できます。次に、逐語化スタイルを決定します:完全逐語化はすべての「um」、誤ったスタート、および繰り返された単語を保持します。これは音声パターンをコーディングしている研究者が必要とするものです。クリーン逐語化はフィラーワードと誤ったスタートを削除しながら、実際のコンテンツを保持します。これがほとんどのジャーナリズムとユーザーリサーチが必要とするものです。第3に、開始前にスピーカーのラベル付け規約(イニシャル、役割、または名前)を選択し、同じプロジェクトのすべてのインタビューで一貫して使用します。第4に、ライブから文字起こしするか、後から記録するか、またはソフトウェアサポートで文字起こしするかを決定します。この選択は、ブロックするのにどれだけの時間を要するかに影響します。
その後に使用するソフトウェアではなく、インタビュー前に選択した文字起こし方法が、待っている編集作業の量を決定します。
- 1
同意と目的を確認する
記録する明示的なPermissionを取得し、文字起こしが公開、内部ノート、または研究データセットのいずれに使用されるかについてのインタビュー対象者に伝えます。
- 2
完全逐語化またはクリーン逐語化を選択する
完全逐語化は、言語または行動分析のためにすべてのフィラーワードと誤ったスタートを保持します。クリーン逐語化はコンテンツを保持しますが、読みやすくするためにUM、繰り返された単語、および誤ったスタートを削除します。
- 3
スピーカーラベル付け規約を設定する
名前、イニシャル、またはインタビュー担当者や参加者などの役割を使用するかどうかを決定し、プロジェクト内のすべてのインタビューで同じ方法で適用します。
- 4
録音セットアップをテストする
実際のインタビューが始まる前に30秒を記録し、それを再生して、両方の声が一貫した音量で聞こえることを確認します。
インタビューを正しく文字起こしする方法:ステップバイステップのプロセス
インタビューが記録されたら、実際の文字起こしは、自分で入力するか、AI生成の下書きから開始するか、言語文字起こし)標準と同様の表記法を使用するかに関わらず、一貫したシーケンスに従います。
オーディオ品質が低下するセクションをキャッチするために、全体的な構造、トーンシフト、およびセクションを見つけるために、入力せずに記録を通してリッスンします。次に、短いパスで文字起こしします。通常は15~30秒のオーディオを一度に、リアルタイムで追いつくのではなく、一時停止と巻き戻しをします。各スピーカーターンを明確にラベル付けし、「右」または「mhm」のような1語の割り込みでも、スピーカーが変わるたびにラベルを再開します。これらの簡潔な応答はトーンにとって重要であり、同意、躊躇、またはトピックの変更を示す可能性があるためです。[inaudible 14:22]のようなブラケット記号で不明なオーディオをマークし、間違った推測は間隙にフラグを立てるよりも悪いため、重複する音声をブラケットでマークします。タイムスタンプを定期的に追加します。毎分またはスピーカーが変わるたびに、誰でも元のオーディオに戻って特定の行を検証できます。最後に、テキストを単独でスキャンするだけではなく、オーディオを聞きながらテキストを読み直して文字起こしを校正します。オーディオとの並行パスは、サイレント校正が見落とす以上のエラーを見つけるためです。
不明なワードを推測して事実として書き込むことは、インタビュー文字起こしが誰かを誤って引用する最も一般的な方法です。
- 1
最初にリッスンスルーパスを実行する
入力を開始する前に、構造、トーン、および不良なオーディオ品質のセクションをキャッチするために、文字起こしなしで完全な記録を1回再生します。
- 2
短いチャンクで文字起こしする
15~30秒のセグメントで機能し、リアルタイムで入力しようとするのではなく、一時停止と巻き戻しを行い、逃したワード数を減らします。
- 3
すべてのターンでスピーカーをラベル付けする
短い応答はしばしば独自の意味を持つため、スピーカーが変わるたびにスピーカーラベルを再開します。簡潔な割り込みを含めます。
- 4
推測ではなく、不明なオーディオにフラグを立てる
スピーカーを誤って引用する可能性のある推測を埋める代わりに、明確に聞こえないものについては[inaudible 14:22]のようなブラケット記号を使用します。
- 5
テキストだけではなくオーディオに対して校正する
文字起こしを読みながら記録を再度聞きます。テキストだけを読むと、リッスンと一緒に行うエラーよりも多くのエラーが見落とされます。
インタビューを文字起こしする例はどのようなものか?
短い例は、フォーマットの選択を具体的にします。タイムスタンプとスピーカーのイニシャルを使用して、自然な会話がクリーン逐語化の文字起こしでどのように見えるかです:
[00:12:04] JS:では、オンボーディングが混乱していると言う場合、具体的にどの部分ですか?
[00:12:09] KP:ほとんど2番目の画面です。カレンダーをすぐに接続する必要があるのか、スキップできるのかが確実ではありませんでした。
[00:12:16] JS:了解。結局スキップしましたか?
[00:12:18] KP:はい、私はそれです。後でそれに戻ることがあると思ったので。
このインタビューの文字起こしの例がどうしているのか、そして何をしていないのかに注目してください。インタビュアーの質問と参加者の完全な答えを要約するのではなく、保持します。ドキュメントの上部にあるキーに関連付けられた一貫したイニシャルを使用します。短い確認の返信(「了解」)を含まれています。これにより、会話がどのように進んだかが示されます。それ自体では情報コンテンツを持たない場合でも。そして、元のオーディオに表示されていたフィラーワード(「um」)と誤ったスタートを省略します。これはフルレッド逐語化ではなく、クリーン逐語化の文字起こしだからです。同じ交換のフル逐語化バージョンは、話しているようにすべての「um」、繰り返された単語、および半完成文を保持します。これは談話分析に重要ですが、ほとんどの研究論文、記事、またはクラスプロジェクトのノイズを追加します。
インタビューを文字起こしするクリーン逐語化とフルレッド逐語化の例の違いは、精度ではなく、文字起こしの後で何をするかです。
他の優れたインタビュー文字起こしを台無しにするものは何か?
ほとんどの文字起こし問題は、回避可能な習慣のいくつかに戻ります。
同意会話をスキップすることは最も深刻なものです。そうしないと、優れたインタビューが公開や研究データセットには使用できなくなる可能性があります。マイクの配置が悪いのが最も一般的です。テーブルにスマートフォンを設置し、インタビュー対象者から3フィート離して配置するため、インタビュアーが明確に来ているにもかかわらず、彼らの回答に大きなギャップがあります。引用文の過度な編集は微妙な間違いです。ソースの文法をきれいにするか、「考えています」や「おそらく」のような適格を削除すると、彼らが言ったことの確実性が変わります。これはジャーナリズムと研究の両方で重要です。
マルチインタビュープロジェクト全体で矛盾するスピーカーラベルでは、後で特にあなたが複数の会話をコーディングしている質的研究では、後で文字起こしを比較するのが難しくなります。オーディオ校正をスキップしてから、チェックすることなく自動化されたドラフトを信頼することもう1つの一般的なギャップです:AIトランスクリプションツールは明確なオーディオで正確ですが、名前、技術用語、またはクロストークの瞬間がまだ修正されずにスリップできます。最後に、すべてをタイムスタンプまたはパラグラフブレークのない密集したテキストブロックとして文字起こしすると、正確な文字起こしでさえ後で検索または引用するのが苦痛になります。文字起こし分析師は、これらのパターンの一部を後で事実に基づいて捕捉するのに役立つことができますが、最初のプロセスで避けるのが速いです。
もう1つの価値のある間違い:文字起こしが完了したら、元の記録のバックアップを保持しないでください。後で引用が挑戦された場合、または研究レビュアーがテキストだけでなく、トーンを聞きたい場合、記録が唯一の質問を決定する情報源です。同じ日付と参加者識別子でラベル付けされた文字起こしと一緒に保存することは、1分かかり、数ヶ月後に長いスクランブルを防ぎます。
引用文をクリーンに聞こえるように編集することは、小さな変更のように見え、事実上読むことができるため、最も損傷を与える間違いです。
Noteelnでインタビューを正しく文字起こしする方法
Noteelnはこのワークフローの両方の半分を処理します。インタビューをキャプチャし、その後実際に機能する文字起こしに変わります。
Noteelnで直接インタビューを記録し、オーディオをオフラインでキャプチャするため、コーヒーショップ、会議室、またはWi-Fiから離れた対人インタビューでの弱い信号がセッションを中断しません。既に電話、個別のレコーダー、またはダウンロードされたビデオコールから記録がある場合は、MP3、M4A、またはWAVファイルをアップロードし、Noteelnは同じトランスクリプションパイプラインを通じて実行されます。どちらの方法でも、アプリはスピーカーターンを自動的にラベル付けし、タイムスタンプの文字起こし、記録の処理が完了したら概要と主要なポイントを生成します。
AI Q&A機能は、インタビュー後に文字起こしをどのように使用するかを変える部分です。40分のテキストをスクロールして、引用する必要のあるそのナンセンを見つける代わりに、直接質問し、関連する通路を取得します。クラスプロジェクト、ユーザー研究の読書、または期限内のストーリーについては、参照する文字起こしから実際にクエリできるものに変わります。記録、専用ソフトウェア、手動文字起こしの間で選択することの詳細については、インタビュー文字起こしソフトウェアの完全な比較を参照してください。
インタビューを正しく文字起こしするための最速の方法は、ソフトウェアに最初のドラフトとタイムスタンプを処理させ、その後、実際に引用する部分の検証に独自の時間を費やすことです。
- 1
インタビューを記録またはアップロードする
Noteelnでライブ記録を開始するか、別のデバイスから既存のMP3、M4A、またはWAVファイルをアップロードします。
- 2
文字起こしと概要を生成させる
Noteelnはスピーカーラベルとタイムスタンプを使用してオーディオを文字起こしし、概要と主要ポイントを自動的に生成します。
- 3
引用する予定のセクションを校正する
手動の文字起こしと同じ方法で、使用する前に直接引用する予定のパッセージをタイムスタンプ付きオーディオに対して確認してください。
- 4
AI Q&Aを使用して特定の回答を取得する
特定の回答または引用を見つける必要がある場合、テキストを読み直すのではなく、直接質問を尋ねます。
最初にインタビュー文字起こしを正しく取得する
インタビューを正しく文字起こしする方法を学ぶことは、一貫して繰り返されるいくつかの習慣に要約されます。最初に同意を得て、開始する前に逐語化スタイルを決定し、移動中にスピーカーとタイムスタンプにラベルを付けます。不明なものにフラグを立ててから推測し、テキストだけではなくオーディオに対して校正します。これらのステップは、学位論文の研究インタビューを文字起こしするか、ロードマップ向けのユーザーインタビューを文字起こしするか、記事向けのソースインタビューを文字起こしするか、クラスの課題のために記録された会話を文字起こしするかに関わらず適用されます。
あなたが使用するツールは、最初のドラフト、スピーカーラベル、タイムスタンプを処理するツールはあなたの時間をより多く残していますが、プロセスは実際に人間が必要とするパートの時間が少なくなります。文字起こしを検証し、アルゴリズムが見逃すコンテキストをキャッチし、インタビューが実際にあなたのプロジェクトにとって何を意味しているかを決定します。Noteelnを試す次の記録された会話と、プロセスから手動のクリーンアップ作業がどのくらい消えるかを見てください。
使用可能な文字起こしに変わるインタビューは、記録が終わった後に修正されるのではなく、開始前にプロセスが決定されたインタビューです。