このページの項目

もっと詳しく

確認・編集・書き出し

音声を聞き直して内容を整え、利用する形式へ保存します。

発話一覧の文字サイズを変える

Mac・Windowsとも、設定の「一般」を開き、「外観」の「文字サイズ」で「標準」「大」「特大」を選びます。標準を100%として、大は125%、特大は150%の大きさです。

閲覧・編集の発話本文、翻訳の原文と翻訳文、音声認識途中の文字、編集欄へすぐに反映されます。文字の大きさに合わせて折り返しと行の高さも調整されます。すべてのセッションで共通の設定で、このパソコンに保存され、セッションを切り替えたりアプリを起動し直したりしても保持されます。

時刻・チャンネル名・ボタンの大きさは変わりません。表示だけの変更なので、本文や発話の時刻、書き出す内容には影響しません。

字幕出力ウィンドウやMojidas Cameraの文字サイズとは別の設定です。配信・共有する字幕の文字サイズは、セッションの「字幕出力の設定…」で調整してください。

閲覧と再生

閲覧
結果を読み、発話行をダブルクリックしてその位置から再生します。スペースキーでも再生/一時停止できます。
行の再生ボタン
発話の左にある再生ボタンを押すと、その発話の開始位置へ移動して音声を確認できます。
波形
保存された波形をクリックして再生位置を移動できます。原文リアルタイムセッションでは「編集」へ切り替えて使います。
現在位置の結果を選択
再生位置に対応する認識結果を一覧で選択します。

波形を拡大して音声を確認する

編集時やファイルセッションの閲覧時は、波形右側の再生ゲインで音量を0〜400%に調整できます。ファイル認識にも開始時のゲインを使用します。詳しくは再生ゲインの調整をご確認ください。ファイルの元セッションで認識する範囲を絞るには、黄色いトリミングハンドルを使います。字幕の発話時刻を調整する白いハンドルとは別の機能です。

虫眼鏡の+/−ボタンで表示する時間幅を変えます。字幕用セッションは初めて開くと5秒幅、それ以外は全体表示です。倍率と再生カーソルの方式はセッションごとに保存され、アプリを起動し直しても復元されます。

再生ボタンの横で、再生速度をx0.5・x1.0・x1.5・x2.0から選べます。初期値はx1.0です。速度はセッションごとに保存され、開き直したときも復元されます。録音や発話の時刻、書き出すデータは変わりません。原文リアルタイムセッションの閲覧モードは対象外です。

Mac版・Windows版ともに、拡大波形の上にマウスカーソルを置き、トラックパッドの2本指スワイプやマウスホイールでも表示範囲を左右に動かせます。通常のホイールの縦回転も横移動になります。波形の外では元のスクロール操作に戻ります。再生位置や発話の時間は変わりません。

拡大波形の下にある横スクロールバーで、表示範囲だけを左右に移動できます。スクロールでは再生位置や字幕の時間は変わりません。手動で移動した後はその範囲を保持し、再生を開始し直すか、波形のシーク・停止中に一覧で別の発話を選択・倍率変更などで通常の再生追従へ戻ります。発話バー本体をクリックすると、その発話を選択して再生カーソルを発話の先頭へ移します。波形の表示範囲はクリック前のまま保持し、中央へ寄せ直したり別のページへ移動したりしません。全体表示とリアルタイムの入力モニターは対象外です。

中央固定/ページ送り
中央へ向いた矢印のボタンがオン(強調色)なら、赤い再生線を中央に固定して波形が流れます。オフ(通常色)なら再生線が右へ進み、右端で次の範囲へ切り替わります。全体表示中は切り替えられません。
発話バー
30秒幅以下にすると波形上部に表示されます。選択した発話はオレンジ、前後の見える発話は青で、同じ行に並びます。本文の先頭を表示し、入りきらない末尾は「...」で省略します。
停止中に一覧で発話を選択
一覧のマウス操作やカーソルキーで発話を選ぶと、その開始位置へ再生位置が移り、波形もその部分を表示します。選択だけでは再生を始めません。「現在位置の結果を選択」は再生位置を動かさずに結果を選びます。

対象はリアルタイムセッションの編集、ファイルセッションの閲覧・編集、すべての翻訳版・字幕編集版の閲覧・編集です。原文リアルタイムセッションの閲覧画面にある入力モニター波形は対象外です。

認識結果を編集する

  1. 結果上部を「編集」へ切り替える

    各発話が編集できる入力欄になります。

  2. 直したい行の再生ボタンを押す

    発話の音声を聞きながら本文を確認します。

  3. 間違っている文字を修正する

    文字入力を始めると再生が止まります。「、」「。」だけの入力では再生を続けます。

  4. Enterで保存して聞き直す

    行を選んだ直後のEnterは、その発話の先頭から再生します。文字を入力した後のEnterは、確認済みとして保存して聞き直します。最初に修正した文字の位置から音声の時刻を推定し、その1秒前から再生します(発話の先頭より前には戻りません)。連続して入力しても最初の修正位置を基準にします。停止中や別の発話を再生中に修正した場合も同じです。翻訳文など、文字と音声の時刻を推定できない場合は、編集した発話の先頭から再生します。行と文字カーソルの位置は維持します。

    文字を追加せずにもう一度Enterを押すと、次の発話へ移動して再生します。最終行では次へ移動しません。

編集モードのショートカット:⌘/Ctrl+↓で再生・停止、⌘/Ctrl+←/→で5秒移動。通常のスペースは文字として入力されます。

本文に改行を入れる

MacはCommand+Enter、WindowsはCtrl+Enterで、文字カーソルの位置に改行を入れます。通常のEnterは改行ではなく、保存・再生・行移動に使います。日本語入力の変換中は、Enterによる変換確定を優先します。

編集を取り消す・やり直す

MacはCommand+Z、WindowsはCtrl+Zで取り消します。やり直しはMacがShift+Command+Z、WindowsがCtrl+YまたはCtrl+Shift+Zです。編集欄の右クリックメニューからも操作できます。

履歴はリアルタイム・ファイル・翻訳・字幕の全セッションで使え、各セッション最大20操作です。発話の入力欄をまたいで編集順に取り消し、字幕の結合・分割・時間調整・リセットも一緒に戻せます。本文の履歴は一文字ごとではなく、行移動や確定などの保存単位です。セッションを切り替えても履歴は残りますが、アプリを終了すると消えます。取り消した後に新たに編集すると、やり直しの履歴は消えます。音声認識中や日本語変換中にはセッションの取り消し・やり直しは行いません。

字幕編集版の作成・編集

字幕編集版の作成、本文修正、結合・分割、波形での時間調整、リセット、SRT/SBV書き出しは、専用ページにまとめました。

Mojidasの利用にはログインが必要です。 閲覧・編集・書き出しを行う前に、ログインまたは無料アカウント作成を完了してください。

テキスト・CSVで書き出す

結果欄右上の「書き出し」メニューから選びます。編集した行は、修正後の本文が出力されます。

テキスト
読みやすい本文として保存します。議事録作成や文章の再利用に向いています。
CSV
時刻、チャンネルなどを表形式で扱いたい場合に使用します。リアルタイムセッションに翻訳結果が1件以上ある場合は「翻訳結果」列も追加されます。翻訳がない発話は空欄になり、翻訳結果が1件もない場合はこの列自体を追加しません。

リアルタイム録音を書き出す

リアルタイムセッションでは「書き出し」→「録音音声(M4A)…」を選べます。音声認識中は書き出せないため、先に音声認識を終了してください。

2チャンネルを別々に書き出す
保存先のフォルダを選び、チャンネルごとに1つのM4Aファイルを作成します。ファイル名にはセッション名、チャンネル番号、チャンネル名が入ります。
2チャンネルを一つにまとめる
両チャンネルを同じ時間位置で重ね、一つのM4Aファイルへ保存します。会話全体を通常の音声ファイルとして聞く場合に向いています。

音声認識を停止して再開したセッションでも、各録音と無音区間の位置を保って書き出します。チャンネル別書き出しで同名ファイルがある場合は、既存ファイルを上書きせず連番を付けます。

SRT・SBV字幕で書き出す

動画・音声セッション、正式翻訳版、字幕編集版では「書き出し」→「字幕用(SRT / SBV)…」を選べます。翻訳版は翻訳文を字幕本文として出力し、元セッションの時間情報を使用します。

字幕編集版からの書き出しでは再分割しません。 現在の本文・改行・字幕の区切り・開始終了時刻を保持したままSRT/SBVへ出力します。言語の選択欄と「分割」セクションは表示されず、選ぶのはファイル形式だけです。相槌の再除外も行いません。以下は原文・翻訳版の書き出しと、字幕編集版の作成時の設定です。

字幕の言語
「日本語」は「。」と自然な文節を優先して分割します。「その他」は認識結果1件を1つの字幕にし、「分割」セクション全体を非表示にします。「日本語」に戻すと設定値を保持したまま再表示します。正式翻訳版では言語は翻訳先に固定され、その言語に合う文字・単語境界で分割します。
ファイル形式
SRTまたはSBVを選びます。利用する動画編集ソフトや配信サービスに合わせてください。字幕編集版の作成時には表示されません。
「分割」の一行の文字数
日本語字幕の目安です。初期値は20文字です。文節や英単語を不自然に切らないため、多少超えることがあります。
一つの字幕の行数
初期値は2行です。
分割地点の時刻
認識結果のタイムタグを文字へ対応させ、字幕の分割位置に近い時刻を開始・終了時刻へ反映します。
句読点を半角スペースに置換する
日本語字幕の「、」を半角スペースへ置き換え、「。」を取り除きます。チェックを外すと句読点を残します。「。」での区切りは、どちらでも維持します。
「はい」や「うん」などの相槌は削除する
句読点の設定の直下にあり、初期状態はオンです。日本語の分割後、相槌・フィラーだけになった字幕を除外します。残したい場合はチェックを外してください。

「。」は文字数より優先します

日本語字幕は設定文字数に届かない短い文も「。」で区切り、文字数調整で前後の文へ結合し直しません。直後の閉じ括弧などは前の文に含めます。翻訳字幕も「。」をまたいで短い文を結合せず、必要なら最低表示時間より短い字幕として残します。作成済み字幕編集版の区切りを自動で変更することはありません。

相槌だけの字幕を除外する

対象は「はい」「うん」「ええ」「えーと」「ええと」「えっと」「あの」「あのー」「えー」「あー」です。空白・改行・句読点を除いた字幕全体が、いずれか1つと一致する場合だけ除外します。「はい、次に進みます」「あの人です」のように本文を含む字幕から、一部の語だけを消すことはありません。

元の認識結果や音声は変更しません。残す字幕の開始・終了時刻も詰めず、除外した区間は字幕のない時間として残します。すべてが除外対象なら出力する字幕はなくなります。「その他」と、作成済み字幕編集版からの書き出しでは相槌を除外しません。

書き出した字幕は、必ず元動画へ読み込んで開始時刻、改行、固有名詞を最終確認してください。