Nova Patents
JP2008508564A

Speech end-pointer

Abstract

Rule-based end pointers separate spoken speech contained within the speech stream from background noise and non-spoken transients. Rule-based end pointers include multiple rules for determining the start and end of spoken speech based on various utterance characteristics. A rule may analyze an audio stream or part of an audio stream based on an event, a combination of events, a continuation of an event, or a continuation of an event. The rules can be manually or dynamically customized depending on the characteristics of the audio stream itself, the expected response contained within the audio stream, or factors that may include ambient conditions.

Term

Term ended

Projected expiry passed 3 April 2026, 0.5 years ago.

  1. Priority
  2. Filed
  3. Published
  4. Projected expiry
  5. Today

39 claims: 5 independent, 34 dependent

  1. 1
    音声発話セグメントの開始および終了のうちの少なくとも一方を決定するエンドポインタであって、該エンドポインタは、 発話事象を含む音声ストリームの一部分を識別する音声トリガーモジュールと、 該音声トリガーモジュールと通信するルールモジュールであって、該ルールモジュールは、該音声ストリームの少なくとも一部を分析することによって、発話事象に関する音声発話セグメントが音声エンドポイント内にあるかを決定する複数の継続時間ルールを含む、ルールモジュールと を備える、エンドポインタ。
  2. 2
    前記音声トリガーモジュールが母音を識別する、請求項1に記載のエンドポインタ。
  3. 3
    前記音声トリガーモジュールがS音またはX音を識別する、請求項1に記載のエンドポインタ。
  4. 4
    前記音声ストリームの前記一部分がフレームを有する、請求項1に記載のエンドポインタ。
  5. 5
    前記ルールモジュールが前記音声ストリームの前記一部分におけるエネルギーの不足を分析する、請求項1に記載のエンドポインタ。
  6. 6
    前記ルールモジュールが前記音声ストリームの前記一部分におけるエネルギーを分析する、請求項1に記載のエンドポインタ。
  7. 7
    前記ルールモジュールが前記音声ストリームの前記一部分における経過時間を分析する、請求項1に記載のエンドポインタ。
  8. 8
    前記ルールモジュールが前記音声ストリームの前記一部分における所定の数の破裂音を分析する、請求項1に記載のエンドポインタ。
  9. 9
    前記ルールモジュールが前記音声発話セグメントの前記開始と終了とを検出する、請求項1に記載のエンドポインタ。
  10. 10
    エネルギー検出器モジュールをさらに備える、請求項1に記載のエンドポインタ。
  11. 11
    マイクロフォン出力部、処理ユニットおよびメモリと通信する、処理環境をさらに備え、前記ルールモジュールは該メモリ内に存在する、請求項1に記載のエンドポインタ。
  12. 12
    複数の決定ルールを有するエンドポインタを用いて音声発話セグメントの開始および終了のうちの少なくとも一方を決定する方法であって、該方法は、 音声ストリームの一部分を受信することと、 該音声ストリームの該一部分がトリガー特性を含むかを決定することと、 少なくとも1つの継続時間決定ルールを該トリガー特性に関する該音声ストリームの一部分に対して適用し、該音声ストリームの該一部分が音声エンドポイント内にあるかを決定することと を包含する、方法。
  13. 13
    前記決定ルールが、前記トリガー特性を含む前記音声ストリームの前記一部分に対して適用される、請求項12に記載の方法。
  14. 14
    前記決定ルールが、前記音声ストリームのうちの前記トリガー特性を含む前記一部分とは異なる一部分に対して適用される、請求項12に記載の方法。
  15. 15
    前記トリガー特性が母音である、請求項12に記載の方法。
  16. 16
    前記トリガー特性がS音またはX音である、請求項12に記載の方法。
  17. 17
    前記音声ストリームの前記一部分がフレームである、請求項12に記載の方法。
  18. 18
    前記ルールモジュールが前記音声ストリームの前記一部分におけるエネルギーの不足を分析する、請求項12に記載の方法。
  19. 19
    前記ルールモジュールが前記音声ストリームの前記一部分におけるエネルギーを分析する、請求項12に記載の方法。
  20. 20
    前記ルールモジュールが前記音声ストリームの前記一部分における経過時間を分析する、請求項12に記載の方法。
  21. 21
    前記ルールモジュールが前記音声ストリームの前記一部分における所定の数の破裂音を分析する、請求項12に記載の方法。
  22. 22
    前記ルールモジュールが潜在的な発話セグメントの開始および終了を検出する、請求項12に記載の方法。
  23. 23
    音声ストリームにおける音声発話セグメントの開始および終了のうちの少なくとも一方を決定するエンドポインタであって、該エンドポインタは、 該音声ストリームのうちの少なくとも1つのダイナミックな局面を分析することによって該音声発話セグメントが音声エンドポイント内にあるかを決定する複数の継続時間ルールを含む、エンドポインタモジュールと、 該エンドポインタモジュールと通信するメモリであって、該複数のルールのうちの1つ以上の継続時間を変更するプロファイル情報を保存するように構成されている、メモリと を備える、エンドポインタ。
  24. 24
    前記音声ストリームの前記ダイナミックな局面が話者の少なくとも1つの特徴を含む、請求項23に記載のエンドポインタ。
  25. 25
    前記話者の前記特徴が話者の話すペースを含む、請求項24に記載のエンドポインタ。
  26. 26
    前記音声ストリームの前記ダイナミックな局面が前記音声ストリームにおけるバックグラウンドノイズを含む、請求項23に記載のエンドポインタ。
  27. 27
    前記音声ストリームの前記ダイナミックな局面が、該音声ストリームにおいて予測された音を含む、請求項23に記載のエンドポインタ。
  28. 28
    前記予測された音が、話者に対して与えられた質問に対する少なくとも1つの予測された回答を含む、請求項27に記載のエンドポインタ。
  29. 29
    マイクロフォン入力部、処理ユニットおよびメモリと通信する、処理環境をさらに備え、前記エンドポインタモジュールは該メモリ内に存在する、請求項23に記載のエンドポインタ。
  30. 30
    音声ストリームにおける音声発話セグメントの開始および終了のうちの少なくとも一方を決定するエンドポインタであって、該エンドポインタは、 周期的な音声信号を含む音声ストリームの一部分を識別する音声トリガーモジュールと、 複数のルールに基づいて認識装置へ入力された該音声ストリームの量を変動させる、エンドポインタモジュールと を備え、 該複数のルールは、周期的な音声信号に関する音声ストリームの一部分が音声エンドポイント内にあるかを決定するための継続時間ルールを含む、エンドポインタ。
  31. 31
    前記認識装置が自動音声認識装置である、請求項30に記載のエンドポインタ。
  32. 32
    音声発話セグメントの開始および終了のうちの少なくとも一方を決定するための命令のセットを含む、コンピュータ可読記憶媒体であって、該命令のセットは、 音波を電気信号に変換することと、 該電気信号の周期性を識別することと、 該識別された周期性に関する該電気信号の可変部分を分析することによって、該電気信号が音声エンドポイント内にあるかを決定することと を含む、コンピュータ可読記憶媒体。
  33. 33
    前記電気信号の可変部分を分析することが、有声発話音の前の継続時間を分析することを含む、請求項32に記載のコンピュータ可読記憶媒体。
  34. 34
    前記電気信号の可変部分を分析することが、有声発話音の後の継続時間を分析することを含む、請求項32に記載のコンピュータ可読記憶媒体。
  35. 35
    前記電気信号の可変部分を分析することが、有声発話音の前または後の推移の数を分析することを含む、請求項32に記載のコンピュータ可読記憶媒体。
  36. 36
    前記電気信号の可変部分を分析することが、有声発話音の前の連続した沈黙の継続を分析することを含む、請求項32に記載のコンピュータ可読記憶媒体。
  37. 37
    前記電気信号の可変部分を分析することが、有声発話音の後の連続した沈黙の継続を分析することを含む、請求項32に記載のコンピュータ可読記憶媒体。
  38. 38
    前記コンピュータ可読媒体が車両のオンボードコンピュータ内に格納されている、請求項32に記載のコンピュータ可読記憶媒体。
  39. 39
    前記コンピュータ可読媒体が音声システムと通信する、請求項32に記載のコンピュータ可読記憶媒体。
Independent claims39