Voice ID とスピーカー名
一度だけ話者の名前を教えれば、以降のすべての録音でWave がその声を自動で認識する。

Wave は録音を話者ごとに自動で分けるけれど、名前まではわからない——だから「Speaker 1」「Speaker 2」のような表示になる。一度名前を付けて Voice ID として保存すれば、以降のすべての録音でその人を自動的にラベル付けしてくれる。
話者に名前が付く3つの方法
- 自分で入力する。 話者名を変更すると、文字起こしと要約のその表示すべてが置き換わる。
- Wave が推測する。 Guess Speaker Names(「話者名を推測」)は会話の内容から名前を推測する(「ありがとう、Sarah」のように)。この方法で名前が付いた話者にはIdentified(「識別済み」)バッジが付く。
- Wave が声を認識する。 Voice ID を保存しておくと、録音の処理中に声を照合し、セッションを開く前に名前を反映しておいてくれる。この場合はMatched(「一致」)バッジと、Very high match、High match、Moderate matchのいずれかの一致度が表示される。
Automatic Voice Matching(「自動音声照合」)がオンになっていれば、新しい録音に対して照合は自動で行われる。この機能はあえて慎重に作られていて、話者の音声が最低10秒必要で、一致度が弱い場合は無理に名前を付けずラベルなしのままにする。
セッション内で話者に名前を付ける
セッションを開き、アクション行のSpeakers(「話者」)をタップ。話者の横にある再生ボタンをタップすると声を確認でき、Enter name(「名前を入力」)欄に入力するか、Guess Speaker Namesをタップして Wave に推測させる。Update summary with speaker names(「話者名で要約を更新」)をオンにすると要約も実名で書き直され、その後保存する。
すでに識別済みの話者がいる場合、推測ボタンはGuess 2 remaining(「残り2件を推測」)のように表示され、この数字はまだ汎用ラベルのままの話者の数を示す。
声を Voice ID として保存する
話者に名前を付けるのは、そのセッション限りの対応。Voice ID を保存すれば、以降のすべてのセッションに反映される。
セッションにはSave voice IDsバナーが表示される:「Name speakers and Wave will recognize them in future recordings.」(話者に名前を付ければ、Wave が今後の録音でも認識します)。タップすると Speakers 画面が開く。
名前を保存するとSave Voice IDs?(「Voice ID を保存しますか?」)シートが表示される。保存したい話者にチェックを入れ、自分にはThis is my voice(「これは自分の声」)を選び、Save Voice IDsをタップ。すでに保存済みの人は「Already saved - will improve recognition」(保存済み — 再保存すると認識精度が向上します)と表示され、再度保存するとプロファイルが強化される。
Wave がプロファイルを作成するには最低10秒の発話が必要で、最も聞き取りやすい部分から最大30秒分を使用する。発話時間が足りない話者はスキップされる。
重複した話者を統合する
長時間の録音やノイズの多い録音では、同じ人が2つのラベルに分かれてしまうことがある。Merge(「統合」)は片方の話者の発言をもう片方に統合する:iPhone と Android では話者行の統合アイコンをタップ、web ではManage Speakers内の統合機能を使う、デスクトップでは文字起こしツールバーのMergeをクリックして2人の話者を選ぶ。
特定の行だけを別の人に移したい場合は、要約と文字起こしの編集を参照。
1つのラベルを2人に分割する
逆のケースもある:2人が1つの名前にまとめられてしまう場合で、たいていは声が似ていたり、発言が重なっていたりするのが原因。実際には2人目の発言である行を選び、それらを独立した話者として分割する——残りの行はそのままそのラベルに残る。
セッションのTranscriptタブを開き、もう一方の人の発言である行を長押しする。リストから該当する人を選んでその行を移動するか、Split into new speaker…(「新しい話者として分割…」)をタップして名前を入力する。
モバイルでは一度に1行ずつしか処理できないので、まとまった量を分割したい場合は web アプリかデスクトップを使う。これらの操作が見当たらない場合は Wave を最新バージョンに更新する。
選択するものはすべて、もともと同じ話者の下にまとまっている必要がある——それが分割対象のラベル。2人目に固有の名前が付いたら、Voice ID として保存しておけば、以降の録音では Wave が2人を自動的に区別してくれるので、毎回自分で直す必要がなくなる。
Voice ID の管理
Settings → Voice ID(Personalization セクション内)。各カードには名前、確信度バッジ、サンプル数、プロファイルが保持している音声の量が表示され、自分のものにはMy Voice(「自分の声」)タグが付く。カードをタップすると名前を変更でき、左にスワイプすると削除、Automatic Voice Matchingで照合機能をオフにできる。
確信度は、プロファイルがどれだけ学習されているかを示す:Building(「構築中」)は音声データが少なく認識が安定しない状態、Good(「良好」)はほとんどの状況で信頼できる状態、Strong(「強固」)は部屋やマイクが変わっても安定して認識できる状態。プロファイルは自然に改善していく——Wave が高い確信度で誰かを認識すると、その録音の音声がプロファイルに取り込まれ、直近の音声ほど重視されるよう重み付けされる。
Voice ID はアカウントに紐づいて全デバイスで同期されるので、スマートフォンで保存した名前はデスクトップでも認識される。
音声プロファイルは安全に保管され、録音内の話者識別のみに使用される。いつでも削除できる。プロファイルには数値化された声の指紋と短い音声クリップが含まれ、そのクリップがPlay sampleで再生されるもの。
よくある質問
たいていは発話量が足りないことが原因——照合には録音内でその人の音声が最低10秒必要。ノイズや発言の重なりも認識を弱める要因になる。あと2〜3回の録音でその人を保存し、セッションでMatch Voice IDs(またはRe-match Voice IDs)を実行して再試行を。
話者を正しい名前に変更して保存する。Wave はその修正を反映し、正しい音声によってプロファイルも改善される。
「Speaker 1」のような汎用ラベルのままの話者は保存できない——web アプリではRename firstと表示される。名前を付けてから登録を。Buildingのままのプロファイルは、あと数回の録音があれば十分。
この記事は役に立ちましたか?
まだお困りですか?