JP6381153B2

Method and apparatus for adjusting volume of user terminal, and terminal

Abstract

This record has no abstract on file.

JP6381153B2, drawing sheet 1
Sheet 1 of 8

Term

8.4 yearsleft in the term

Expires 12 February 2035.

  1. Priority
  2. Filed
  3. Granted
  4. Today
  5. Expires

16 claims: 5 independent, 11 dependent

  1. 1
    ユーザ端末によって実行される、前記 ユーザ端末の音量を調整する方法であって、 前記ユーザ端末の周囲の音声信号を収集するステップと、 前記音声信号の組成情報を取得するために、前記収集した音声信号の分析を実行するステップであって、前記組成情報は、前記音声信号に含まれる音声タイプ、および様々なタイプの音声の比率を含み、前記音声タイプは、無音、人声、およびノイズを含む、分析を実行するステップと、 前記音声信号の前記組成情報に従って、前記ユーザ端末の現在のシーンモードを決定するステップと、 前記決定したシーンモードに従って、前記ユーザ端末の前記音量を調整するステップとを含む、方法。
  2. 2
    前記ユーザ端末の周囲の音声信号を収集する前記ステップが、具体的に、 呼び出し信号の到達が検出されたときに、前記ユーザ端末が置かれている現在の環境の音声信号を収集すること、または、 前記ユーザ端末が置かれている現在の環境の音声信号を定期的に収集することを含む、請求項1に記載の方法。
  3. 3
    前記決定したシーンモードに従って、前記ユーザ端末の前記音量を調整する、前記ステップが、 前記決定したシーンモード、ならびにシーンモードと音量調整係数との間の予め記憶した対応関係に従って、音量調整係数を決定することと、前記音量調整係数に従って、前記ユーザ端末の前記音量を調整することとを含む、請求項2に記載の方法。
  4. 4
    前記ユーザ端末の前記音量が、着信音量および受話音量を含み、前記音量調整係数が、着信音量調整係数、および受話音量調整係数を含み、 前記音量調整係数に従って、前記ユーザ端末の前記音量を調整する前記ステップが、 前記着信音量調整係数に従って、前記ユーザ端末の前記着信音量を調整することと、前記受話音量調整係数に従って、前記ユーザ端末の前記受話音量を調整することとを含む、請求項3に記載の方法。
  5. 5
    前記呼び出し信号の接続が検出された後に、 前記ユーザ端末のマイク音量をリアルタイムで取得するステップと、 前記取得したマイク音量が、予め記憶した基準音量よりも大きいときに、前記ユーザ端末の前記受話音量を大きくするステップと、 前記取得したマイク音量が、前記予め記憶した基準音量よりも小さいときに、前記ユーザ端末の前記受話音量を小さくするステップとをさらに含む、請求項4に記載の方法。
  6. 6
    前記呼び出し信号の接続が検出された後に、 前記ユーザ端末の周囲の前記音声信号を定期的に収集するステップ、および前記音声信号の前記組成情報を取得するために、前記収集した音声信号の分析を実行するステップと、 前記音声信号の前記組成情報に従って、前記音声信号が人声を含むかどうか、および1人のみの声を含むかどうかを判定するステップであって、前記音声信号が、人声を含み、かつ1人のみの声を含む場合は、前記音声信号の音量を計算し、前記音声信号の前記計算した音量と前記予め記憶した基準音量との平均値を取り、前記平均値を新たな基準音量として記憶する、判定するステップとをさらに含む、請求項5に記載の方法。
  7. 7
    前記音声信号の組成情報を取得するために、前記収集した音声信号の分析を実行する、前記ステップが、具体的に、 前記収集した音声信号を複数の音声データに分割することと、 各音声データの音声周波数を計算すること、ならびに前記計算した音声周波数に従って、前記各音声データを無音、人声、およびノイズに分類することと、 全ての音声データの無音、人声、およびノイズの比率の統計を収集することであって、 人声と識別された音声データについては、人声の音声データのメル周波数ケプストラム係数を計算し、前記人声に含まれる人数についての情報を判定するために、メル周波数ケプストラム係数が同一の音声データを1人の声として統計を収集することとを含む、請求項6に記載の方法。
  8. 8
    前記計算した音声周波数に従って、各音声データを無音、人声、およびノイズに分類する、前記ステップが、具体的に、 前記各音声データの前記音声周波数が、20Hz~20000Hzの範囲内にあるかどうかを決定することであって、 前記音声データの前記音声周波数が、20Hz~20000Hzの前記範囲内にあると決定されたときは、前記音声データの基本周波数を計算し、 前記基本周波数が、85Hz~255Hzの範囲内にあると決定されたときは、前記音声データは人声であるとみなし、 前記基本周波数が、85Hz~255Hzの前記範囲外にあると決定されたときは、前記音声データはノイズであるとみなし、 前記音声データの前記音声周波数が、20Hz~20000Hzの前記範囲外にあると決定されたときは、前記音声データは無音であるとみなす、決定することを含む、請求項7に記載の方法。
  9. 9
    コンピュータ読み取り可能なプログラムを記憶するように構成されたメモリと、 前記メモリから前記コンピュータ読み取り可能なプログラムを読み取るように構成されたプロセッサであって、 ユーザ端末の周囲の音声信号を収集することと、 前記音声信号の組成情報を得るために、前記収集した音声信号の分析を実行することであって、前記組成情報は、前記音声信号に含まれる音声タイプ、および様々なタイプの音声の比率を含み、前記音声タイプは、無音、人声、およびノイズを含む、分析を実行することと、 前記音声信号の前記組成情報に従って、前記ユーザ端末の現在のシーンモードを決定することと、 前記決定したシーンモードに従って、前記ユーザ端末の音量を調整することとを実行する、 プロセッサとを備える、端末。
  10. 10
    前記プロセッサが、呼び出し信号の到達が検出されたときに、前記ユーザ端末が置かれている現在の環境の音声信号を収集するように構成され、または、 前記プロセッサが、前記ユーザ端末が置かれている現在の環境の音声信号を定期的に収集するように構成される、請求項9に記載の端末。
  11. 11
    前記プロセッサが、前記決定したシーンモード、およびシーンモードと音量調整係数との間の予め記憶した対応関係に従って音量調整係数を決定するように、かつ前記音量調整係数に従って、前記ユーザ端末の前記音量を調整するように構成される、請求項10に記載の端末。
  12. 12
    前記ユーザ端末の前記音量が、着信音量および受話音量を含み、前記音量調整係数が、着信音量調整係数、および受話音量調整係数を含み、 前記プロセッサが、前記着信音量調整係数に従って前記ユーザ端末の前記着信音量を調整し、前記受話音量調整係数に従って前記ユーザ端末の前記受話音量を調整するように構成される、請求項11に記載の端末。
  13. 13
    前記呼び出し信号の接続が検出された後に、前記プロセッサが、前記ユーザ端末のマイク音量をリアルタイムで取得し、前記取得したマイク音量が、予め記憶した基準音量よりも大きいときは、前記ユーザ端末の前記受話音量を大きくし、前記取得したマイク音量が、前記予め記憶した基準音量よりも小さいときは、前記ユーザ端末の前記受話音量を小さくするようにさらに構成される、請求項12に記載の端末。
  14. 14
    前記呼び出し信号の接続が検出された後に、前記プロセッサが、 前記ユーザ端末の周囲の前記音声信号を定期的に収集して、前記音声信号の前記組成情報を得るために、前記収集した音声信号の分析を実行し、 前記音声信号の前記組成情報に従って、前記音声信号が人声を含み、かつ1人のみの声を含むかどうかを判定し、前記音声信号が人声を含み、かつ1人のみの声を含む場合は、前記音声信号の音量を計算し、前記音声信号の前記計算した音量と、前記予め記憶した基準音量との平均値を取り、前記平均値を新たな基準音量として記憶するようにさらに構成される、請求項13に記載の端末。
  15. 15
    前記プロセッサが、 前記収集した音声信号を複数の音声データに分割し、 各音声データの音声周波数を計算し、前記計算した音声周波数に従って、各音声データを無音、人声、およびノイズに分類し、 全ての音声データの無音、人声、およびノイズの比率の統計を収集し、 人声として識別された音声データについては、人声の音声データのメル周波数ケプストラム係数を計算し、前記人声に含まれる人数についての情報を判定するために、メル周波数ケプストラム係数が同一の音声データを1人の声として統計を収集するように構成される、請求項14に記載の端末。
  16. 16
    コンピュータ読み取り可能なプログラムであって、プロセッサによって読み取られると、前記プロセッサが、 ユーザ端末の周囲の音声信号を収集し、 前記音声信号の組成情報を得るために、前記収集した音声信号の分析を実行し、前記組成情報は、前記音声信号に含まれる音声タイプ、および様々なタイプの音声の比率を含み、前記音声タイプは、無音、人声、およびノイズを含み、 前記音声信号の前記組成情報に従って、前記ユーザ端末の現在のシーンモードを決定し、 前記決定したシーンモードに従って、前記ユーザ端末の音量を調整する、 コンピュータ読み取り可能なプログラムを含む、非一時的記憶媒体。
Independent claims16