JP2017514392A

Method and apparatus for adjusting volume of user terminal, and terminal

Abstract

The present invention discloses a volume control method and device, and a terminal. After the voice signal around the user terminal is collected, analysis of the collected voice signal is performed in order to acquire the composition information of the voice signal, and the composition information includes the voice type included in the voice signal and various types. The audio type includes silence, human voice, and noise, and the current scene mode of the user terminal is determined according to the composition information of the audio signal, and the volume of the user terminal is determined according to the determined scene mode. It will be adjusted. Once the current scene mode of the user terminal is determined, a reference for the composition information of the audio signal is added so that the corresponding current scene is closer to the actual scene and more accurately matched to the scene in which the user is located. This makes it possible to significantly reduce the occurrence of a situation caused by an error in determining the scene, that is, the adjustment of the playback volume does not match the scene, and improve the usability of the user.

JP2017514392A, drawing sheet 1
Sheet 1 of 9

Term

8.4 yearsto projected expiry

Projected expiry 12 February 2035, counted from filing; an application has no term until it is granted.

  1. Priority
  2. Filed
  3. Published
  4. Today
  5. Projected expiry

17 claims: 6 independent, 11 dependent

  1. 1
    ユーザ端末の音量を調整する方法であって、 前記ユーザ端末の周囲の音声信号を収集するステップと、 前記音声信号の組成情報を取得するために、前記収集した音声信号の分析を実行するステップであって、前記組成情報は、前記音声信号に含まれる音声タイプ、および前記様々なタイプの音声の比率を含み、前記音声タイプは、無音、人声、およびノイズを含む、分析を実行するステップと、 前記音声信号の前記組成情報に従って、前記ユーザ端末の現在のシーンモードを決定するステップと、 前記決定したシーンモードに従って、前記ユーザ端末の前記音量を調整するステップとを含む、方法。
  2. 2
    前記ユーザ端末の周囲の音声信号を収集する前記ステップが、具体的に、 呼び出し信号の到達が検出されたときに、前記ユーザ端末が置かれている現在の環境の音声信号を収集すること、または、 前記ユーザ端末が置かれている現在の環境の音声信号を定期的に収集することを含む、請求項1に記載の方法。
  3. 3
    前記決定したシーンモードに従って、前記ユーザ端末の前記音量を調整する、前記ステップが、 前記決定したシーンモード、ならびにシーンモードと音量調整係数との間の予め記憶した対応関係に従って、音量調整係数を決定することと、前記音量調整係数に従って、前記ユーザ端末の前記音量を調整することとを含む、請求項1または2に記載の方法。
  4. 4
    前記ユーザ端末の前記音量が、着信音量および受話音量を含み、前記音量調整係数が、着信音量調整係数、および受話音量調整係数を含み、 前記音量調整係数に従って、前記ユーザ端末の前記音量を調整する前記ステップが、 前記着信音量調整係数に従って、前記ユーザ端末の前記着信音量を調整することと、前記受話音量調整係数に従って、前記ユーザ端末の前記受話音量を調整することとを含む、請求項3に記載の方法。
  5. 5
    前記呼び出し信号の接続が検出された後に、 前記ユーザ端末のマイク音量をリアルタイムで取得するステップと、 前記取得したマイク音量が、予め記憶した基準音量よりも大きいときに、前記ユーザ端末の前記受話音量を大きくするステップと、 前記取得したマイク音量が、前記予め記憶した基準音量よりも小さいときに、前記ユーザ端末の前記受話音量を小さくするステップとをさらに含む、請求項1~4のいずれか一項に記載の方法。
  6. 6
    前記呼び出し信号の接続が検出された後に、 前記ユーザ端末の周囲の前記音声信号を定期的に収集するステップ、および前記音声信号の前記組成情報を取得するために、前記収集した音声信号の分析を実行するステップと、 前記音声信号の前記組成情報に従って、前記音声信号が人声を含むかどうか、および1人のみの声を含むかどうかを判定するステップであって、前記音声信号が、人声を含み、かつ1人のみの声を含む場合は、前記音声信号の音量を計算し、前記音声信号の前記計算した音量と前記予め記憶した基準音量との平均値を取り、前記平均値を新たな基準音量として記憶する、判定するステップとをさらに含む、請求項5に記載の方法。
  7. 7
    前記音声信号の組成情報を取得するために、前記収集した音声信号の分析を実行する、前記ステップが、具体的に、 前記収集した音声信号を複数の音声データに分割することと、 前記各音声データの音声周波数を計算すること、ならびに前記計算した音声周波数に従って、前記各音声データを無音、人声、およびノイズに分類することと、 全ての音声データの無音、人声、およびノイズの比率の統計を収集することであって、 人声と識別された音声データについては、人声の音声データのメル周波数ケプストラム係数を計算し、前記人声に含まれる人数についての情報を判定するために、メル周波数ケプストラム係数が同一の音声データを1人の声として統計を収集することとを含む、請求項1~6のいずれか一項に記載の方法。
  8. 8
    前記計算した音声周波数に従って、各音声データを無音、人声、およびノイズに分類する、前記ステップが、具体的に、 前記各音声データの前記音声周波数が、20Hz~20000Hzの範囲内にあるかどうかを決定することであって、 前記音声データの前記音声周波数が、20Hz~20000Hzの前記範囲内にあると決定されたときは、前記音声データの基本周波数を計算し、 前記基本周波数が、85Hz~255Hzの範囲内にあると決定されたときは、前記音声データは人声であるとみなし、 前記基本周波数が、85Hz~255Hzの前記範囲外にあると決定されたときは、前記音声データはノイズであるとみなし、 前記音声データの前記音声周波数が、20Hz~20000Hzの前記範囲外にあると決定されたときは、前記音声データは無音であるとみなす、決定することを含む、請求項7に記載の方法。
  9. 9
    ユーザ端末の音量を調整する装置であって、 前記ユーザ端末の周囲の音声信号を収集するように構成された、収集ユニットと、 前記音声信号の組成情報を取得するために、前記収集した音声信号の分析を実行するように構成された分析ユニットであって、前記組成情報は、前記音声信号に含まれる音声タイプ、および前記様々なタイプの音声の比率を含み、前記音声タイプは、無音、人声、およびノイズを含む、分析ユニットと、 前記音声信号の前記組成情報に従って、前記ユーザ端末の現在のシーンモードを決定するように構成された、シーンモード決定ユニットと、 前記決定したシーンモードに従って、前記ユーザ端末の前記音量を調整するように構成された、音量調整ユニットとを備える、装置。
  10. 10
    前記収集ユニットが、具体的に、 呼び出し信号の到達が検出されたときに、前記ユーザ端末が置かれている現在の環境の音声信号を収集するように、または、 前記ユーザ端末が置かれている現在の環境の音声信号を定期的に収集するように構成される、請求項9に記載の装置。
  11. 11
    前記音量調整ユニットが、具体的に、前記決定したシーンモード、ならびにシーンモードと音量調整係数との間の予め記憶した対応関係に従って、音量調整係数を決定し、前記音量調整係数に従って、前記ユーザ端末の前記音量を調整するように構成される、請求項9または10に記載の装置。
  12. 12
    前記ユーザ端末の前記音量が、着信音量および受話音量を含み、前記音量調整ユニットの前記音量調整係数が、具体的に、着信音量調整係数、および受話音量調整係数を含み、 前記音量調整ユニットが、具体的に、前記着信音量調整係数に従って、前記ユーザ端末の前記着信音量を調整し、前記受話音量調整係数に従って、前記ユーザ端末の前記受話音量を調整する、音量調整係数、および受話音量調整係数を含む、請求項11に記載の装置。
  13. 13
    前記呼び出し信号の接続が検出された後に、前記ユーザ端末のマイク音量をリアルタイムで取得するように構成された取得ユニットと、 前記取得したマイク音量の大きさと、予め記憶した基準音量とを比較するように構成された比較ユニットであって、 前記音量調整ユニットが、前記取得したマイク音量が、前記予め記憶した基準音量よりも大きいときに、前記ユーザ端末の前記受話音量を大きくし、前記取得したマイク音量が、前記予め記憶した基準音量よりも小さいときに、前記ユーザ端末の前記受話音量を小さくするようにさらに構成された、比較ユニットをさらに含む、請求項9~12のいずれか一項に記載の装置。
  14. 14
    前記収集ユニットが、具体的に、前記呼び出し信号の接続が検出された後に、前記ユーザ端末の周囲の前記音声信号を定期的に収集するように構成され、 前記分析ユニットが、前記音声信号の前記組成情報を取得するために、前記呼び出し信号の接続が検出された後に、前記収集モジュールによって定期的に収集された前記音声信号の分析を実行するように、かつ前記音声信号の前記組成情報に従って、前記音声信号が、人声を含むかどうか、ならびに1人のみの声を含むかどうかを決定するようにさらに構成され、前記音声信号が、人声を含み、かつ1人のみの声を含む場合は、前記音声信号の音量を計算し、前記前記音声信号の前記計算した音量と、前記予め記憶した基準音量との平均値を取り、前記平均値を新たな基準音量として記憶する、請求項13に記載の装置。
  15. 15
    前記分析ユニットが、具体的に、 前記収集した音声信号を複数の音声データに分割するように構成された、第1の処理ユニットと、 前記各音声データの音声周波数を計算し、かつ前記計算した音声周波数に従って、前記各音声データを無音、人声、およびノイズに分類するように構成された、第2の処理ユニットと、 全ての音声データの、無音、人声、およびノイズの比率の統計を収集するように構成された、第3の処理ユニットと、 人声と識別された音声データについては、メル周波数ケプストラム係数を計算し、前記人声に含まれる人数についての情報を判定するために、メル周波数ケプストラム係数が同一の音声データを1人の声として統計値を収集する、第4の処理ユニットとを備える、請求項9~14のいずれか一項に記載の装置。
  16. 16
    前記第2の処理ユニットが、具体的に、 前記各音声データの前記音声周波数が、20Hz~20000Hzの範囲内にあるかどうかを判定し、 前記音声データの前記音声周波数が、20Hz~20000Hzの前記範囲内にあると判定されたときは、前記音声データの基本周波数を計算し、 前記基本周波数が、85Hz~255Hzの範囲内にあると判定されたときは、前記音声データは人声であるとみなし、 前記基本周波数が、85Hz~255Hzの前記範囲外にあると判定されたときは、前記音声データはノイズであるとみなし、 前記音声データの前記音声周波数が、20Hz~20000Hzの前記範囲外にあると判定されたときは、前記音声データは無音であるとみなすように構成される、請求項15に記載の装置。
  17. 17
    スピーカおよび受話器を備え、請求項9~16のいずれか一項に記載の前記音量調整装置をさらに備える、端末。
Independent claims17