Nova Patents
JP5598331B2

Language model creation device

Abstract

This record has no abstract on file.

Term

Projected expiry 3 September 2029.

  1. Priority
  2. Filed
  3. Granted
  4. Today
  5. Projected expiry

25 claims: 8 independent, 17 dependent

  1. 1
    第1の内容を表す単語列において特定の単語が出現する確率を表す第1の内容別言語モデルと、第2の内容を表す単語列において前記特定の単語が出現する確率を表す第2の内容別言語モデルと、を記憶する内容別言語モデル記憶手段と、 音声に対応する単語列を認識する音声認識処理を行うことにより生成された音声認識仮説に含まれる単語列であって入力された単語列である入力単語列の少なくとも一部である処理対象単語列が表す内容が前記第1の内容である確率を表す第1の確率パラメータと、当該処理対象単語列が表す内容が前記第2の内容である確率を表す第2の確率パラメータと、を取得するとともに、当該取得された第1の確率パラメータと、当該取得された第2の確率パラメータと、前記記憶されている第1の内容別言語モデルと、前記記憶されている第2の内容別言語モデルと、に基づいて、前記音声のうちの前記処理対象単語列に対応する部分に対応する単語列において前記特定の単語が出現する確率を表す言語モデルを作成する言語モデル作成処理を行う言語モデル作成手段と、 を備え、前記言語モデル作成手段は、ある処理対象単語列に対して前記取得された第1の確率パラメータが、予め設定された上限閾値よりも大きい場合、その処理対象単語列に隣接する処理対象単語列に対して前記取得された第1の確率パラメータを増加させるように補正する、 言語モデル作成装置。
  2. 2
    請求項1に記載の言語モデル作成装置であって、 前記言語モデル作成手段は、 前記取得された第1の確率パラメータ及び前記取得された第2の確率パラメータの両方が、予め設定された下限閾値よりも小さい場合、前記取得された第1の確率パラメータ及び前記取得された第2の確率パラメータの両方を同一の値に設定するように構成された言語モデル作成装置。
  3. 3
    第1の内容を表す単語列において特定の単語が出現する確率を表す第1の内容別言語モデルと、第2の内容を表す単語列において前記特定の単語が出現する確率を表す第2の内容別言語モデルと、を記憶する内容別言語モデル記憶手段と、 音声に対応する単語列を認識する音声認識処理を行うことにより生成された音声認識仮説に含まれる単語列であって入力された単語列である入力単語列の少なくとも一部である処理対象単語列が表す内容が前記第1の内容である確率を表す第1の確率パラメータと、当該処理対象単語列が表す内容が前記第2の内容である確率を表す第2の確率パラメータと、を取得するとともに、当該取得された第1の確率パラメータと、当該取得された第2の確率パラメータと、前記記憶されている第1の内容別言語モデルと、前記記憶されている第2の内容別言語モデルと、に基づいて、前記音声のうちの前記処理対象単語列に対応する部分に対応する単語列において前記特定の単語が出現する確率を表す言語モデルを作成する言語モデル作成処理を行う言語モデル作成手段と、 を備え、前記言語モデル作成手段は、前記取得された第1の確率パラメータ及び前記取得された第2の確率パラメータの両方が、予め設定された下限閾値よりも小さい場合、前記取得された第1の確率パラメータ及び前記取得された第2の確率パラメータの両方を同一の値に設定する、 言語モデル作成装置。
  4. 4
    請求項1乃至請求項3のいずれか一項に記載の言語モデル作成装置であって、 前記言語モデル作成手段は、前記音声認識処理によって認識された単語列の単語間の境界を境界として前記入力単語列を分割した複数の前記処理対象単語列のそれぞれに対して、前記言語モデル作成処理を行うように構成された言語モデル作成装置。
  5. 5
    請求項1乃至請求項3のいずれか一項に記載の言語モデル作成装置であって、 前記言語モデル作成手段は、前記音声認識処理によって認識された単語列の単語間の境界と異なる位置を境界として前記入力単語列を分割した複数の前記処理対象単語列のそれぞれに対して、前記言語モデル作成処理を行うように構成された言語モデル作成装置。
  6. 6
    請求項1乃至請求項5のいずれか一項に記載の言語モデル作成装置であって、 前記言語モデル作成手段は、 前記取得された第1の確率パラメータが大きくなるほど大きくなる第1の係数を前記第1の内容別言語モデルが表す確率に乗じた値と、前記取得された第2の確率パラメータが大きくなるほど大きくなる第2の係数を前記第2の内容別言語モデルが表す確率に乗じた値と、の和が大きくなるほど、前記音声のうちの前記処理対象単語列に対応する部分に対応する単語列において前記特定の単語が出現する確率が大きくなる前記言語モデルを作成するように構成された言語モデル作成装置。
  7. 7
    請求項1乃至請求項6のいずれか一項に記載の言語モデル作成装置であって、 前記言語モデル作成手段は、条件付確率場の理論に基づいて前記第1の確率パラメータ及び前記第2の確率パラメータを取得するように構成された言語モデル作成装置。
  8. 8
    請求項1乃至請求項7のいずれか一項に記載の言語モデル作成装置であって、 前記言語モデル作成手段は、前記処理対象単語列に含まれる単語の属性を表す単語属性情報、及び、前記処理対象単語列を音声から認識する音声認識処理を行う際に取得された音声認識処理情報、の少なくとも1つに基づいて前記第1の確率パラメータ及び前記第2の確率パラメータを取得するように構成された言語モデル作成装置。
  9. 9
    請求項8に記載の言語モデル作成装置であって、 前記単語属性情報は、単語表層を表す情報、読みを表す情報、及び、品詞を表す情報の少なくとも1つを含む言語モデル作成装置。
  10. 10
    請求項8又は請求項9に記載の言語モデル作成装置であって、 前記音声認識処理情報は、前記音声認識処理による認識結果の信頼度である認識信頼度を表す情報、1つの音が継続する時間である継続時間長を表す情報、及び、先行する無音の有無を表す情報の少なくとも1つを含む言語モデル作成装置。
  11. 11
    請求項1乃至請求項10のいずれか一項に記載の言語モデル作成装置であって、 前記言語モデル作成手段は、 前記入力単語列における前記処理対象単語列の位置を表す情報、前記入力単語列が1つの単語を複数含むことを表す情報、前記入力単語列における内容の連接状態を表す情報、及び、前記入力単語列が複数存在する場合における各入力単語列間の関係を表す情報、の少なくとも1つに基づいて前記第1の確率パラメータ及び前記第2の確率パラメータを取得するように構成された言語モデル作成装置。
  12. 12
    第1の内容を表す単語列において特定の単語が出現する確率を表す第1の内容別言語モデルと、第2の内容を表す単語列において前記特定の単語が出現する確率を表す第2の内容別言語モデルと、を記憶する内容別言語モデル記憶手段と、 音声に対応する単語列を認識する音声認識処理を行うことにより生成された音声認識仮説に含まれる単語列であって入力された単語列である入力単語列の少なくとも一部である処理対象単語列が表す内容が前記第1の内容である確率を表す第1の確率パラメータと、当該処理対象単語列が表す内容が前記第2の内容である確率を表す第2の確率パラメータと、を取得するとともに、当該取得された第1の確率パラメータと、当該取得された第2の確率パラメータと、前記記憶されている第1の内容別言語モデルと、前記記憶されている第2の内容別言語モデルと、に基づいて、前記音声のうちの前記処理対象単語列に対応する部分に対応する単語列において前記特定の単語が出現する確率を表す言語モデルを作成する言語モデル作成処理を行う言語モデル作成手段と、 前記言語モデル作成手段により作成された言語モデルに基づいて、入力された音声に対応する単語列を認識する音声認識処理を行う音声認識手段と、 を備え、前記言語モデル作成手段は、ある処理対象単語列に対して前記取得された第1の確率パラメータが、予め設定された上限閾値よりも大きい場合、その処理対象単語列に隣接する処理対象単語列に対して前記取得された第1の確率パラメータを増加させるように補正する、 音声認識装置。
  13. 13
    第1の内容を表す単語列において特定の単語が出現する確率を表す第1の内容別言語モデルと、第2の内容を表す単語列において前記特定の単語が出現する確率を表す第2の内容別言語モデルと、を記憶する内容別言語モデル記憶手段と、 音声に対応する単語列を認識する音声認識処理を行うことにより生成された音声認識仮説に含まれる単語列であって入力された単語列である入力単語列の少なくとも一部である処理対象単語列が表す内容が前記第1の内容である確率を表す第1の確率パラメータと、当該処理対象単語列が表す内容が前記第2の内容である確率を表す第2の確率パラメータと、を取得するとともに、当該取得された第1の確率パラメータと、当該取得された第2の確率パラメータと、前記記憶されている第1の内容別言語モデルと、前記記憶されている第2の内容別言語モデルと、に基づいて、前記音声のうちの前記処理対象単語列に対応する部分に対応する単語列において前記特定の単語が出現する確率を表す言語モデルを作成する言語モデル作成処理を行う言語モデル作成手段と、 前記言語モデル作成手段により作成された言語モデルに基づいて、入力された音声に対応する単語列を認識する音声認識処理を行う音声認識手段と、 を備え、前記言語モデル作成手段は、前記取得された第1の確率パラメータ及び前記取得された第2の確率パラメータの両方が、予め設定された下限閾値よりも小さい場合、前記取得された第1の確率パラメータ及び前記取得された第2の確率パラメータの両方を同一の値に設定する、 音声認識装置。
  14. 14
    請求項12又は請求項13に記載の音声認識装置であって、 前記言語モデル作成手段は、 前記取得された第1の確率パラメータが大きくなるほど大きくなる第1の係数を前記第1の内容別言語モデルが表す確率に乗じた値と、前記取得された第2の確率パラメータが大きくなるほど大きくなる第2の係数を前記第2の内容別言語モデルが表す確率に乗じた値と、の和が大きくなるほど、前記音声のうちの前記処理対象単語列に対応する部分に対応する単語列において前記特定の単語が出現する確率が大きくなる前記言語モデルを作成するように構成された音声認識装置。
  15. 15
    請求項12乃至請求項14のいずれか一項に記載の音声認識装置であって、 前記音声認識手段は、前記入力された音声に対応する単語列を認識する前記音声認識処理を行うことにより前記入力単語列を生成するように構成され、 前記言語モデル作成手段は、前記音声認識手段により生成された前記入力単語列に基づいて前記言語モデルを作成するように構成され、 前記音声認識手段は、前記言語モデル作成手段により作成された前記言語モデルに基づいて、前記入力された音声に対応する単語列を認識する前記音声認識処理を再度行うように構成された音声認識装置。
  16. 16
    請求項12乃至請求項15のいずれか一項に記載の音声認識装置であって、 前記言語モデル作成手段によって作成された言語モデルに基づいて、前記音声認識手段が前記入力された音声に対応する単語列を認識する前記音声認識処理と、前記音声認識手段によって認識された単語列に基づいて、前記言語モデル作成手段が前記言語モデルを作成する前記言語モデル作成処理と、を交互に繰り返す反復処理を実行するように構成された音声認識装置。
  17. 17
    請求項16に記載の音声認識装置であって、 所定の終了条件が成立した場合、前記反復処理を終了するように構成された音声認識装置。
  18. 18
    請求項17に記載の音声認識装置であって、 前記終了条件は、前回の前記音声認識処理により認識された単語列と、今回の前記音声認識処理により認識された単語列と、が一致しているという条件である音声認識装置。
  19. 19
    請求項17に記載の音声認識装置であって、 前記終了条件は、前記音声認識処理を実行した回数が予め設定された閾値回数よりも大きいという条件である音声認識装置。
  20. 20
    第1の内容を表す単語列において特定の単語が出現する確率を表す第1の内容別言語モデルと、第2の内容を表す単語列において前記特定の単語が出現する確率を表す第2の内容別言語モデルと、が記憶装置に記憶されている場合に、 音声に対応する単語列を認識する音声認識処理を行うことにより生成された音声認識仮説に含まれる単語列であって入力された単語列である入力単語列の少なくとも一部である処理対象単語列が表す内容が前記第1の内容である確率を表す第1の確率パラメータと、当該処理対象単語列が表す内容が前記第2の内容である確率を表す第2の確率パラメータと、を取得するとともに、当該取得された第1の確率パラメータと、当該取得された第2の確率パラメータと、前記記憶されている第1の内容別言語モデルと、前記記憶されている第2の内容別言語モデルと、に基づいて、前記音声のうちの前記処理対象単語列に対応する部分に対応する単語列において前記特定の単語が出現する確率を表す言語モデルを作成し、ある処理対象単語列に対して前記取得された第1の確率パラメータが、予め設定された上限閾値よりも大きい場合、その処理対象単語列に隣接する処理対象単語列に対して前記取得された第1の確率パラメータを増加させるように補正する、 言語モデル作成方法。
  21. 21
    第1の内容を表す単語列において特定の単語が出現する確率を表す第1の内容別言語モデルと、第2の内容を表す単語列において前記特定の単語が出現する確率を表す第2の内容別言語モデルと、が記憶装置に記憶されている場合に、 音声に対応する単語列を認識する音声認識処理を行うことにより生成された音声認識仮説に含まれる単語列であって入力された単語列である入力単語列の少なくとも一部である処理対象単語列が表す内容が前記第1の内容である確率を表す第1の確率パラメータと、当該処理対象単語列が表す内容が前記第2の内容である確率を表す第2の確率パラメータと、を取得するとともに、当該取得された第1の確率パラメータと、当該取得された第2の確率パラメータと、前記記憶されている第1の内容別言語モデルと、前記記憶されている第2の内容別言語モデルと、に基づいて、前記音声のうちの前記処理対象単語列に対応する部分に対応する単語列において前記特定の単語が出現する確率を表す言語モデルを作成し、前記取得された第1の確率パラメータ及び前記取得された第2の確率パラメータの両方が、予め設定された下限閾値よりも小さい場合、前記取得された第1の確率パラメータ及び前記取得された第2の確率パラメータの両方を同一の値に設定する、 言語モデル作成方法。
  22. 22
    請求項20又は請求項21に記載の言語モデル作成方法であって、 前記取得された第1の確率パラメータが大きくなるほど大きくなる第1の係数を前記第1の内容別言語モデルが表す確率に乗じた値と、前記取得された第2の確率パラメータが大きくなるほど大きくなる第2の係数を前記第2の内容別言語モデルが表す確率に乗じた値と、の和が大きくなるほど、前記音声のうちの前記処理対象単語列に対応する部分に対応する単語列において前記特定の単語が出現する確率が大きくなる前記言語モデルを作成するように構成された言語モデル作成方法。
  23. 23
    情報処理装置に、 第1の内容を表す単語列において特定の単語が出現する確率を表す第1の内容別言語モデルと、第2の内容を表す単語列において前記特定の単語が出現する確率を表す第2の内容別言語モデルと、を記憶装置に記憶させる内容別言語モデル記憶処理手段と、 音声に対応する単語列を認識する音声認識処理を行うことにより生成された音声認識仮説に含まれる単語列であって入力された単語列である入力単語列の少なくとも一部である処理対象単語列が表す内容が前記第1の内容である確率を表す第1の確率パラメータと、当該処理対象単語列が表す内容が前記第2の内容である確率を表す第2の確率パラメータと、を取得するとともに、当該取得された第1の確率パラメータと、当該取得された第2の確率パラメータと、前記記憶されている第1の内容別言語モデルと、前記記憶されている第2の内容別言語モデルと、に基づいて、前記音声のうちの前記処理対象単語列に対応する部分に対応する単語列において前記特定の単語が出現する確率を表す言語モデルを作成する言語モデル作成手段と、 を実現させるための言語モデル作成プログラムであり、前記言語モデル作成手段は、ある処理対象単語列に対して前記取得された第1の確率パラメータが、予め設定された上限閾値よりも大きい場合、その処理対象単語列に隣接する処理対象単語列に対して前記取得された第1の確率パラメータを増加させるように補正するように構成された、 言語モデル作成プログラム。
  24. 24
    情報処理装置に、 第1の内容を表す単語列において特定の単語が出現する確率を表す第1の内容別言語モデルと、第2の内容を表す単語列において前記特定の単語が出現する確率を表す第2の内容別言語モデルと、を記憶装置に記憶させる内容別言語モデル記憶処理手段と、 音声に対応する単語列を認識する音声認識処理を行うことにより生成された音声認識仮説に含まれる単語列であって入力された単語列である入力単語列の少なくとも一部である処理対象単語列が表す内容が前記第1の内容である確率を表す第1の確率パラメータと、当該処理対象単語列が表す内容が前記第2の内容である確率を表す第2の確率パラメータと、を取得するとともに、当該取得された第1の確率パラメータと、当該取得された第2の確率パラメータと、前記記憶されている第1の内容別言語モデルと、前記記憶されている第2の内容別言語モデルと、に基づいて、前記音声のうちの前記処理対象単語列に対応する部分に対応する単語列において前記特定の単語が出現する確率を表す言語モデルを作成する言語モデル作成手段と、 を実現させるための言語モデル作成プログラムであり、前記言語モデル作成手段は、前記取得された第1の確率パラメータ及び前記取得された第2の確率パラメータの両方が、予め設定された下限閾値よりも小さい場合、前記取得された第1の確率パラメータ及び前記取得された第2の確率パラメータの両方を同一の値に設定するように構成された、 言語モデル作成プログラム。
  25. 25
    請求項23又は請求項24に記載の言語モデル作成プログラムであって、 前記言語モデル作成手段は、 前記取得された第1の確率パラメータが大きくなるほど大きくなる第1の係数を前記第1の内容別言語モデルが表す確率に乗じた値と、前記取得された第2の確率パラメータが大きくなるほど大きくなる第2の係数を前記第2の内容別言語モデルが表す確率に乗じた値と、の和が大きくなるほど、前記音声のうちの前記処理対象単語列に対応する部分に対応する単語列において前記特定の単語が出現する確率が大きくなる前記言語モデルを作成するように構成された言語モデル作成プログラム。
Independent claims25