Nova Patents
JP2017520008A

Hotword detection on multiple devices

Abstract

Disclosed are methods, systems, and devices that include computer programs encoded on computer recording media for hotword detection on multiple devices. In one aspect, the method comprises the operation of receiving audio data corresponding to an utterance by a first computing device. The method further includes the action of determining a first value corresponding to the possibility that the utterance contains a hot word. The method further comprises the action of receiving a second value corresponding to the possibility that the utterance contains a hotword, the second value being determined by the second computing device. The method further includes the operation of comparing the first value with the second value. The method further includes an operation of initiating a speech recognition process on the audio data based on the result of comparison between the first value and the second value.

JP2017520008A, drawing sheet 1
Sheet 1 of 4

Term

9 yearsto projected expiry

Projected expiry 29 September 2035, counted from filing; an application has no term until it is granted.

  1. Priority
  2. Filed
  3. Published
  4. Today
  5. Projected expiry

20 claims: 5 independent, 15 dependent

  1. 1
    コンピュータによって実施される方法であって、 第1コンピューティングデバイスにより、発話に対応するオーディオデータを受信するステップと、 前記発話がホットワードを含む可能性に対応する第1の値を決定するステップと、 前記発話が前記ホットワードを含む可能性に対応する第2の値を受信するステップであって、前記第2の値は第2コンピューティングデバイスによって決定される、ステップと、 前記第1の値と前記第2の値とを比較するステップと、 前記第1の値と前記第2の値との比較結果に基づいて、前記オーディオデータに対する音声認識処理を開始するステップと を有する方法。
  2. 2
    前記第1の値がホットワードスコアしきい値に達していると判定するステップ をさらに有する、請求項1に記載の方法。
  3. 3
    前記第1の値を前記第2コンピューティングデバイスに送信するステップ をさらに有する、請求項1に記載の方法。
  4. 4
    前記第1の値と前記第2の値との比較結果に基づいて、前記第1コンピューティングデバイスの起動状態を決定するステップ をさらに有する、請求項1に記載の方法。
  5. 5
    前記第1の値と前記第2の値との比較結果に基づいて、前記第1コンピューティングデバイスの起動状態を決定する前記ステップが、 前記起動状態がアクティブ状態であると判定するステップ を含む、請求項4に記載の方法。
  6. 6
    前記第1コンピューティングデバイスにより、追加的な発話に対応する追加的なオーディオデータを受信するステップと、 前記追加的な発話が前記ホットワードを含む可能性に対応する第3の値を決定するステップと、 前記追加的な発話が前記ホットワードを含む可能性に対応する第4の値を受信するステップであって、前記第4の値は第3コンピューティングデバイスによって決定される、ステップと、 前記第3の値と前記第4の値とを比較するステップと、 前記第3の値と前記第4の値との比較結果に基づいて、前記第1コンピューティングデバイスの起動状態が非アクティブ状態であると判定するステップと をさらに有する、請求項1に記載の方法。
  7. 7
    前記第1の値を前記第2コンピューティングデバイスに送信する前記ステップが、 前記第1の値を、ローカルネットワークを介して又は短距離無線通信を介して、サーバに送信するステップ を含み、 前記発話が前記ホットワードを含む可能性に対応する第2の値を受信するステップであって、前記第2の値は第2コンピューティングデバイスによって決定される、前記ステップが、 前記第2コンピューティングデバイスによって決定された前記第2の値を、前記ローカルネットワークを介して又は前記短距離無線通信を介して、前記サーバから受信するステップ を含む、請求項3に記載の方法。
  8. 8
    前記第2コンピューティングデバイスを識別するステップと、 前記ホットワードを含む発話に応答するように前記第2コンピューティングデバイスが構成されていると判定するステップと をさらに有する、請求項1に記載の方法。
  9. 9
    前記第1の値を前記第2コンピューティングデバイスに送信する前記ステップが、 前記第1コンピューティングデバイスに対する第1識別子を送信するステップ を含み、 前記発話が前記ホットワードを含む可能性に対応する第2の値を受信するステップであって、前記第2の値は第2コンピューティングデバイスによって決定される、前記ステップが、 前記第2コンピューティングデバイスに対する第2識別子を受信するステップ を含む、請求項3に記載の方法。
  10. 10
    前記起動状態がアクティブ状態であると判定する前記ステップが、 前記発話に対応する前記オーディオデータを受信してから所定の時間が経過したと判定するステップ を含む、請求項5に記載の方法。
  11. 11
    前記起動状態がアクティブ状態であると判定したことに基づいて、所定の時間、前記第1の値を送信し続けるステップ をさらに有する、請求項5に記載の方法。
  12. 12
    コンピューティングデバイスであって、 命令を格納した1つ又は複数のストレージデバイスを具備し、 前記命令は、前記コンピューティングデバイスによって実行されたとき、前記コンピューティングデバイスに、 第1コンピューティングデバイスにより、発話に対応するオーディオデータを受信する手順と、 前記発話がホットワードを含む可能性に対応する第1の値を決定する手順と、 前記発話が前記ホットワードを含む可能性に対応する第2の値を受信する手順であって、前記第2の値は第2コンピューティングデバイスによって決定される、手順と、 前記第1の値と前記第2の値とを比較する手順と、 前記第1の値と前記第2の値との比較結果に基づいて、前記オーディオデータに対する音声認識処理を開始する手順と を含む動作を実行させる、デバイス。
  13. 13
    前記動作が、 前記第1の値がホットワードスコアしきい値に達していると判定する手順 をさらに含む、請求項12に記載のデバイス。
  14. 14
    前記動作が、 前記第1の値を前記第2コンピューティングデバイスに送信する手順 をさらに含む、請求項12に記載のデバイス。
  15. 15
    前記動作が、 前記第1の値と前記第2の値との比較結果に基づいて、前記第1コンピューティングデバイスの起動状態を決定する手順 をさらに含む、請求項12に記載のデバイス。
  16. 16
    前記第1の値と前記第2の値との比較結果に基づいて、前記第1コンピューティングデバイスの起動状態を決定する前記手順が、 前記起動状態がアクティブ状態であると判定する手順 を含む、請求項15に記載のデバイス。
  17. 17
    前記動作が、 前記第1コンピューティングデバイスにより、追加的な発話に対応する追加的なオーディオデータを受信する手順と、 前記追加的な発話が前記ホットワードを含む可能性に対応する第3の値を決定する手順と、 前記追加的な発話が前記ホットワードを含む可能性に対応する第4の値を受信する手順であって、前記第4の値は第3コンピューティングデバイスによって決定される、手順と、 前記第3の値と前記第4の値とを比較する手順と、 前記第3の値と前記第4の値との比較結果に基づいて、前記第1コンピューティングデバイスの起動状態が非アクティブ状態であると判定する手順と をさらに含む、請求項12に記載のデバイス。
  18. 18
    前記第1の値を前記第2コンピューティングデバイスに送信する前記手順が、 前記第1の値を、ローカルネットワークを介して又は短距離無線通信を介して、サーバに送信する手順 を含み、 前記発話が前記ホットワードを含む可能性に対応する第2の値を受信する手順であって、前記第2の値は第2コンピューティングデバイスによって決定される、前記手順が、 前記第2コンピューティングデバイスによって決定された前記第2の値を、前記ローカルネットワークを介して又は前記短距離無線通信を介して、前記サーバから受信する手順 を含む、請求項14に記載のデバイス。
  19. 19
    前記動作が、 前記第2コンピューティングデバイスを識別する手順と、 前記ホットワードを含む発話に応答するように前記第2コンピューティングデバイスが構成されていると判定する手順と をさらに含む、請求項12に記載のデバイス。
  20. 20
    1つ又は複数のコンピュータによって実行可能な命令を含むソフトウェアを格納した、非一時的なコンピュータ読み取り可能な記録媒体であって、 前記命令は、その実行時に、前記1つ又は複数のコンピュータに、 第1コンピューティングデバイスにより、発話に対応するオーディオデータを受信する手順と、 前記発話がホットワードを含む可能性に対応する第1の値を決定する手順と、 前記発話が前記ホットワードを含む可能性に対応する第2の値を受信する手順であって、前記第2の値は第2コンピューティングデバイスによって決定される、手順と、 前記第1の値と前記第2の値とを比較する手順と、 前記第1の値と前記第2の値との比較結果に基づいて、前記オーディオデータに対する音声認識処理を開始する手順と を含む動作を実行させる、非一時的なコンピュータ読み取り可能な記録媒体。
Independent claims20