JP5118280B2

Natural language interface control system

Abstract

This record has no abstract on file.

JP5118280B2, drawing sheet 1
Sheet 1 of 1

Term

Term ended

Expired 19 October 2020, 5.9 years ago.

  1. Priority
  2. Filed
  3. Granted
  4. Expired
  5. Today

34 claims: 9 independent, 25 dependent

  1. 1
    複数のデバイスを操作する自然言語インターフェースコントロールシステムであって、 三次元マイクロフォンセットと、 上記三次元マイクロフォンセットに接続された特徴抽出モジュール であって、音声検出を行い、発生音の開始部及び終了部における多数の余分サンプルを用いることによって開始部及び終了部の無音を見つけ、開始部及び終了部の無音を除去することにより、発生音の音声部分を取り出す特徴抽出モジュール と、 上記特徴抽出モジュールに接続されている音声認識モジュールであって、隠れマルコフモデルを用いて、異なる音声モデル間、及び、異なる文法間で切り替えを行うことができる音声認識モジュールと、 を有し、少なくとも一つの異なる音声モデル及び少なくとも一つの異なる文法がネットワークを通じてダウンロードされ、 さらに、自然言語インターフェースコントロールシステムは、 上記音声認識モジュールに接続された自然言語インタフェースモジュールと、 上記自然言語インターフェースモジュールに接続されたデバイスインターフェースとを有し、上記自然言語インターフェースモジュールは、ユーザからの非プロンプト式で開放型の自然言語要求に基づいて、上記デバイスインターフェースに接続された一又は二以上のタイプからなる複数のデバイスを操作し、 上記自然言語インターフェースモジュールは、上記複数のデバイスのそれぞれを、上記複数のデバイスのそれぞれに対応する異なる文法のそれぞれと複数の語彙目録のそれぞれに抽象化することを特徴とする自然言語インターフェースコントロールシステム。
  2. 2
    上記自然言語インターフェースモジュールに接続された上記複数のデバイスをさらに有することを特徴とする請求の範囲第1項記載の自然言語インターフェースコントロールシステム。
  3. 3
    上記音声認識モジュールはNグラムグラマーを用いることを特徴とする請求の範囲第1項記載の自然言語インターフェースコントロールシステム。
  4. 4
    上記自然言語インターフェースモジュールは確率的コンテキストフリーグラマーを用いることを特徴とする請求の範囲第1項記載の自然言語インターフェースコントロールシステム。
  5. 5
    上記三次元マイクロフォンセットは、平面マイクロフォンセットと、空間的に異なる平面に配置された少なくとも1つのリニアマイクロフォンセットとを備えることを特徴とする請求の範囲第1項記載の自然言語インターフェースコントロールシステム。
  6. 6
    上記デバイスインターフェースは無線デバイスインターフェースからなることを特徴とする請求の範囲第1項記載の自然言語インターフェースコントロールシステム。
  7. 7
    上記自然言語インターフェースコントロールシステムに接続された外部ネットワークインターフェースをさらに有することを特徴とする請求の範囲第1項記載の自然言語インターフェースコントロールシステム。
  8. 8
    上記三次元マイクロフォンセットが有する第1のマイクロフォンセットと、上記特徴抽出モジュールと、上記音声認識モジュールと、上記自然言語インターフェースモジュールとを有するリモートユニットをさらに有することを特徴とする請求の範囲第1項記載の自然言語インターフェースコントロールシステム。
  9. 9
    上記リモートユニットに接続されたベースユニットをさらに有することを特徴とする請求の範囲第8項記載の自然言語インターフェースコントロールシステム。
  10. 10
    上記ベースユニットは上記三次元マイクロフォンセットが有する第2のマイクロフォンセットを含むことを特徴とする請求の範囲第9項記載の自然言語インターフェースコントロールシステム。
  11. 11
    上記第1のマイクロフォンセットと上記第2のマイクロフォンセットとは、上記三次元マイクロフォンセットを実現することを特徴とする請求の範囲第1項記載の自然言語インターフェースコントロールシステム。
  12. 12
    複数のデバイスを操作する自然言語インターフェースコントロールシステムであって、 三次元マイクロフォンセットと、 上記三次元マイクロフォンセットに接続された特徴抽出モジュール であって、音声検出を行い、発生音の開始部及び終了部における多数の余分サンプルを用いることによって開始部及び終了部の無音を見つけ、開始部及び終了部の無音を除去することにより、発生音の音声部分を取り出す特徴抽出モジュール と、 上記特徴抽出モジュールに接続されている音声認識モジュールであって、隠れマルコフモデルを用いて、異なる音声モデル間、及び、異なる文法間で切り替えを行うことができる音声認識モジュールと、 上記音声認識モジュールに接続された自然言語インタフェースモジュールと、 上記自然言語インターフェースモジュールに接続されたデバイスインターフェースとを有し、上記自然言語インターフェースモジュールは、ユーザからの非プロンプト式で開放型の自然言語要求に基づいて、上記デバイスインターフェースに接続された一又は二以上のタイプからなる複数のデバイスを操作し、 上記自然言語インターフェースモジュールは、上記複数のデバイスのそれぞれを、上記複数のデバイスのそれぞれに対応する複数の文法のそれぞれと複数の語彙目録のそれぞれに抽象化することを特徴とする自然言語インターフェースコントロールシステム。
  13. 13
    複数のデバイスを操作する自然言語インターフェースコントロールシステムであって、 三次元マイクロフォンセットと、 上記三次元マイクロフォンセットに接続された特徴抽出モジュール であって、音声検出を行い、発生音の開始部及び終了部における多数の余分サンプルを用いることによって開始部及び終了部の無音を見つけ、開始部及び終了部の無音を除去することにより、発生音の音声部分を取り出す特徴抽出モジュール と、 上記特徴抽出モジュールに接続されている音声認識モジュールであって、隠れマルコフモデルを用いて、異なる音声モデル間、及び、異なる文法間で切り替えを行うことができる音声認識モジュールと、 上記音声認識モジュールに接続された自然言語インタフェースモジュールと、 上記自然言語インターフェースモジュールに接続されたデバイスインターフェースとを有し、上記自然言語インターフェースモジュールは、ユーザからの非プロンプト式で開放型の自然言語要求に基づいて、上記デバイスインターフェースに接続された一又は二以上のタイプからなる複数のデバイスを操作し、 上記自然言語インターフェースモジュールは、アテンションワードを受け取って認識すると、上記非プロンプト式で開放型のユーザ要求をサーチすることを特徴とする自然言語インターフェースコントロールシステム。
  14. 14
    複数のデバイスを操作する自然言語インターフェースコントロールシステムであって、 三次元マイクロフォンセットと、 上記三次元マイクロフォンセットに接続された特徴抽出モジュール であって、音声検出を行い、発生音の開始部及び終了部における多数の余分サンプルを用いることによって開始部及び終了部の無音を見つけ、開始部及び終了部の無音を除去することにより、発生音の音声部分を取り出す特徴抽出モジュール と、 上記特徴抽出モジュールに接続されている音声認識モジュールであって、隠れマルコフモデルを用いて、異なる音声モデル間、及び、異なる文法間で切り替えを行うことができる音声認識モジュールと、 上記音声認識モジュールに接続された自然言語インタフェースモジュールと、 上記自然言語インターフェースモジュールに接続されたデバイスインターフェースとを有し、上記自然言語インターフェースモジュールは、ユーザからの非プロンプト式で開放型の自然言語要求に基づいて、上記デバイスインターフェースに接続された一又は二以上のタイプからなる複数のデバイスを操作し、 上記自然言語インターフェースモジュールは、アテンションワードを受け取って認識すると、文法、音声モデル、語彙目録のコンテキスト切り換えを行うことを特徴とする自然言語インターフェースコントロールシステム。
  15. 15
    複数のデバイスを操作する自然言語インターフェースコントロールシステムであって、 三次元マイクロフォンセットと、 上記三次元マイクロフォンセットに接続された特徴抽出モジュール であって、音声検出を行い、発生音の開始部及び終了部における多数の余分サンプルを用いることによって開始部及び終了部の無音を見つけ、開始部及び終了部の無音を除去することにより、発生音の音声部分を取り出す特徴抽出モジュール と、 上記特徴抽出モジュールに接続されている音声認識モジュールであって、隠れマルコフモデルを用いて、異なる音声モデル間、及び、異なる文法間で切り替えを行うことができる音声認識モジュールと、 上記音声認識モジュールに接続された自然言語インタフェースモジュールと、 上記自然言語インターフェースモジュールに接続されたデバイスインターフェースとを有し、上記自然言語インターフェースモジュールは、ユーザからの非プロンプト式で開放型の自然言語要求に基づいて、上記デバイスインターフェースに接続された一又は二以上のタイプからなる複数のデバイスを操作し、 さらに、自然言語インターフェースコントロールシステムは、 上記複数のデバイスそれぞれについての異なる文法を記憶するためのグラマーモジュールを有することを特徴とする自然言語インターフェースコントロールシステム。
  16. 16
    複数のデバイスを操作する自然言語インターフェースコントロールシステムであって、 三次元マイクロフォンセットと、 上記三次元マイクロフォンセットに接続された特徴抽出モジュール であって、音声検出を行い、発生音の開始部及び終了部における多数の余分サンプルを用いることによって開始部及び終了部の無音を見つけ、開始部及び終了部の無音を除去することにより、発生音の音声部分を取り出す特徴抽出モジュール と、 上記特徴抽出モジュールに接続されている音声認識モジュールであって、隠れマルコフモデルを用いて、異なる音声モデル間、及び、異なる文法間で切り替えを行うことができる音声認識モジュールと、 上記音声認識モジュールに接続された自然言語インタフェースモジュールと、 上記自然言語インターフェースモジュールに接続されたデバイスインターフェースとを有し、上記自然言語インターフェースモジュールは、ユーザからの非プロンプト式で開放型の自然言語要求に基づいて、上記デバイスインターフェースに接続された一又は二以上のタイプからなる複数のデバイスを操作し、 さらに、自然言語インターフェースコントロールシステムは、 上記複数のデバイスそれぞれについての異なる音声モデルを記憶するための音声モデルモジュールを有することを特徴とする自然言語インターフェースコントロールシステム。
  17. 17
    複数のデバイスを操作する自然言語インターフェースコントロールシステムであって、 第1のマイクロフォンと、 上記第1のマイクロフォンに接続された特徴抽出モジュール であって、音声検出を行い、発生音の開始部及び終了部における多数の余分サンプルを用いることによって開始部及び終了部の無音を見つけ、開始部及び終了部の無音を除去することにより、発生音の音声部分を取り出す特徴抽出モジュール と、 上記特徴抽出モジュールに接続されている音声認識モジュールと、 上記音声認識モジュールに接続された自然言語インタフェースモジュールと、 上記自然言語インターフェースモジュールに接続されたデバイスインターフェースとを有し、当該自然言語インターフェースモジュールは、ユーザからの非プロンプト式で開放型の自然言語要求に基づいて、上記デバイスインターフェースに接続された一又は二以上のタイプからなる複数のデバイスを操作し、 さらに、自然言語インターフェースコントロールシステムは、 上記自然言語インターフェースコントロールシステムに接続されている外部ネットワークインタフェースを有し、上記自然言語インターフェースモジュールは、上記複数のデバイスのそれぞれを、上記複数のデバイスのそれぞれに対応する複数の文法のそれぞれと複数の語彙目録のそれぞれに抽象化することを特徴とする自然言語インターフェースコントロールシステム。
  18. 18
    上記自然言語インターフェースモジュールに接続されている上記複数のデバイスをさらに有することを特徴とする請求の範囲第17項記載の自然言語インターフェースコントロールシステム。
  19. 19
    上記音声認識モジュールはNグラムグラマーを用いることを特徴とする請求の範囲第17項記載の自然言語インターフェースコントロールシステム。
  20. 20
    上記自然言語インターフェースモジュールは確率的コンテキストフリーグラマーを用いることを特徴とする請求の範囲第17項記載の自然言語インターフェースコントロールシステム。
  21. 21
    上記第1のマイクロフォンは、平面マイクロフォンセットと、空間的に異なる平面に配置された少なくとも1つのリニアマイクロフォンセットとを備える三次元マイクロフォンセットを有することを特徴とする請求の範囲第17項記載の自然言語インターフェースコントロールシステム。
  22. 22
    上記自然言語インターフェースモジュールは、アテンションワードを受け取って認識すると、非プロンプト式で開放型のユーザ要求をサーチすることを特徴とする請求の範囲第17項記載の自然言語インターフェースコントロールシステム。
  23. 23
    上記自然言語インターフェースモジュールは、アテンションワードを受け取って認識すると、文法、音声モデル、語彙目録のコンテキスト切り換えを行うことを特徴とする請求の範囲第17項記載の自然言語インターフェースコントロールシステム。
  24. 24
    上記複数のデバイスのそれぞれについて異なる文法を記憶するグラマーモジュールをさらに有することを特徴とする請求の範囲第17項記載の自然言語インターフェースコントロールシステム。
  25. 25
    上記複数のデバイスのそれぞれについて異なる音声モデルを記憶する音声モデルモジュールをさらに有することを特徴とする請求の範囲第17項記載の自然言語インターフェースコントロールシステム。
  26. 26
    上記デバイスインターフェースは無線デバイスインターフェースからなることを特徴とする請求の範囲第17項記載の自然言語インターフェースコントロールシステム。
  27. 27
    上記第1のマイクロフォンと、上記特徴抽出モジュールと、上記音声認識モジュールと、上記自然言語インターフェースモジュールとを有するリモートユニットをさらに有することを特徴とする請求の範囲第17項記載の自然言語インターフェースコントロールシステム。
  28. 28
    上記リモートユニットに接続されたベースユニットをさらに有することを特徴とする請求の範囲第27項記載の自然言語インターフェースコントロールシステム。
  29. 29
    上記ベースユニットは第2のマイクロフォンセットを有することを特徴とする請求の範囲第28項記載の自然言語インターフェースコントロールシステム。
  30. 30
    上記第1のマイクロフォンは、第1のマイクロフォンセットを有し、当該第1のマイクロフォンセットと上記第2のマイクロフォンセットは、三次元マイクロフォンセットを実現することを特徴とする請求の範囲第29項記載の自然言語インターフェースコントロールシステム。
  31. 31
    上記外部ネットワークインタフェースに接続されている中央データベースであって、文法、音声モデル、抽象化されたデバイス、プログラミング情報、語彙目録のうちの少なくとも一つを有する中央データベースをさらに有することを特徴とする請求の範囲第17項記載の自然言語インターフェースコントロールシステム。
  32. 32
    上記中央データベースは、外部ネットワークを介して上記外部ネットワークインタフェースに接続されていることを特徴とする請求の範囲第31項記載の自然言語インターフェースコントロールシステム。
  33. 33
    上記外部ネットワーク及び上記中央データベースに接続されているリモートサーバをさらに有することを特徴とする請求の範囲第32項記載の自然言語インターフェースコントロールシステム。
  34. 34
    他の自然言語インターフェースコントロールシステムと、 上記他の自然言語インターフェースコントロールシステム及び上記外部ネットワークに接続されている他の外部ネットワークインタフェースと、をさらに有することを特徴とする請求の範囲第32項記載の自然言語インターフェースコントロールシステム。
Independent claims34