JP5363588B2

Device and method for synchronizing received audio data with video data

Abstract

This record has no abstract on file.

Term

Projected expiry 8 December 2028.

  1. Priority and filed
  2. Granted
  3. Today
  4. Projected expiry

18 claims: 4 independent, 14 dependent

  1. 1
    通信装置(12)により受信された、複数のビデオデータセグメントを含むビデオデータと、前記通信装置により受信された、複数のオーディオデータセグメントを含むオーディオデータとを同期させる方法であって、 オーディオデータの第1セグメントを前記通信装置(12)で受信するステップと、 前記オーディオデータの第1セグメントと同時又はそれより遅い時点で、該 オーディオデータの 第1 セグメント に論理的に関連するビデオデータの第1セグメントを前記通信装置(12)で受信するステップと、 前記オーディオデータの第1セグメントの始まりに関連する事前通知を前記通信装置で発生するとともに、前記オーディオデータの第1セグメントの始まりを再生する前に、前記事前通知を示す視覚情報を表示し、又は、前記事前通知を示すオーディオ情報を再生する ステップと、 前記事前通知を示す視覚情報を表示し、又は、前記事前通知を示すオーディオ情報を再生した後に、 前記オーディオデータの第1セグメントと前記ビデオデータの第1セグメントとの間に同期処理を適用するステップと、 を有することを特徴とする方法。
  2. 2
    前記オーディオデータの最終セグメントの終わりに関連する事前通知を前記通信装置で発生するステップと、 前記オーディオデータの最終セグメントの終わりを再生する前に、前記事前通知を示す視覚情報を表示し、又は、前記事前通知を示すオーディオ情報を再生するステップと、 を更に有することを特徴とする請求項1に記載の方法。
  3. 3
    前記視覚情報を画像又は文字として前記通信装置の画面に表示し、又は、光源により発生される光として表示し、又は、音声を放射するために前記オーディオデータを処理するステップを更に有することを特徴とする請求項1に記載の方法。
  4. 4
    顔の有無を検出するために前記受信されたビデオデータの第1セグメントを分析するステップを更に有することを特徴とする請求項1に記載の方法。
  5. 5
    前記ビデオデータの第1セグメント中に前記顔が存在する確率を判定するために前記受信されたビデオデータの第1セグメントをフィルタリングするステップを更に有することを特徴とする請求項4に記載の方法。
  6. 6
    前記判定された確率が所定の閾値確率より高い場合に前記同期処理をオンするステップを更に有することを特徴とする請求項5に記載の方法。
  7. 7
    対応する後続ビデオデータセグメントにおいて次に判定された顔が存在する確率が前記所定の閾値確率より低い場合は前記同期処理をオフするステップを更に有することを特徴とする請求項6に記載の方法。
  8. 8
    前記同期処理を適用するステップは、 前記ビデオデータの第1セグメントを受信又は復号化する前に、前記オーディオデータの第1セグメントの始まりを再生するステップと、 所定の速度より遅い低再生速度で少なくとも前記オーディオデータの第1セグメントを再生するステップと、 前記ビデオデータの第1セグメントを再生のために利用可能である場合、前記オーディオデータの第1セグメント又はそれに続くセグメントの前記低再生速度を前記所定の速度まで上げるステップと、 を含むことを特徴とする請求項1に記載の方法。
  9. 9
    前記オーディオデータの最終セグメントを前記通信装置で受信するステップと、 前記オーディオデータの最終セグメントと同時又はそれより遅い時点で、前記オーディオデータの最終セグメントに論理的に関連する前記ビデオデータの最終セグメントを前記通信装置で受信するステップと、 前記オーディオデータの最終セグメントと前記ビデオデータの最終セグメントとが同期しないように、所定の速度より速い高再生速度で前記オーディオデータの最終セグメントを再生するステップと、 前記ビデオデータの最終セグメントの再生を終了する前に、前記オーディオデータの最終セグメントの再生を終了するステップと、 を更に有することを特徴とする請求項1に記載の方法。
  10. 10
    複数のビデオデータセグメントを含む受信したビデオデータと、複数のオーディオデータセグメントを含む受信したオーディオデータとを同期させる通信装置(12)であって、 オーディオデータの第1セグメントを受信し、該オーディオデータの第1セグメントと同時又はそれより遅い時点で、該オーディオデータの第1セグメントに論理的に関連するビデオデータの第1セグメントを受信する入出力ユニット(18)と、 前記オーディオデータの第1セグメントの始まりに関連する事前通知を発生するとともに、前記オーディオデータの第1セグメントの始まりを再生する前に、前記事前通知を示す視覚情報を表示し、又は、前記事前通知を示すオーディオ情報を再生 し、前記事前通知を示す視覚情報を表示し、又は、前記事前通知を示すオーディオ情報を再生した後に、 前記オーディオデータの第1セグメントと前記ビデオデータの第1セグメントとの間に同期処理を適用するプロセッサ(24)と、 を有することを特徴とする通信装置。
  11. 11
    前記プロセッサは、更に、 前記オーディオデータの最終セグメントの終わりに関連する事前通知を発生し、 前記オーディオデータの最終セグメントの終わりを再生する前に、前記事前通知を示す視覚情報を表示し、又は、前記事前通知を示すオーディオ情報を再生する ことを特徴とする請求項10に記載の通信装置。
  12. 12
    前記視覚情報を前記通信装置の画面に画像又は文字として表示し、又は、光源により発生される光として表示する表示ユニット、又は、 前記オーディオデータを音声として再生する音声再生ユニット、 を更に有することを特徴とする請求項10に記載の通信装置。
  13. 13
    前記プロセッサは、更に、 顔の有無を検出するために前記受信されたビデオデータの第1セグメントを分析することを特徴とする請求項10に記載の通信装置。
  14. 14
    前記プロセッサは、更に、 前記ビデオデータの第1セグメント中に前記顔が存在する確率を判定するために前記受信されたビデオデータの第1セグメントをフィルタリングすることを特徴とする請求項13に記載の通信装置。
  15. 15
    前記プロセッサは、更に、 前記判定された確率が所定の閾値確率より高い場合に前記同期処理をオンすることを特徴とする請求項14に記載の通信装置。
  16. 16
    前記プロセッサは、更に、 対応する後続ビデオデータセグメントにおいて次に判定された顔が存在する確率が前記所定の閾値確率より低い場合は前記同期処理をオフすることを特徴とする請求項14に記載の通信装置。
  17. 17
    前記プロセッサは、更に、 前記ビデオデータの第1セグメントを受信又は復号化する前に、少なくとも前記オーディオデータの第1セグメントを再生し、 所定の速度より遅い低再生速度で前記オーディオデータの第1セグメントを再生し、 前記ビデオデータの第1セグメントを再生のために利用可能である場合、前記オーディオデータの第1セグメント又はそれに続くオーディオデータセグメントの前記低再生速度を前記所定の速度まで上げる ことを特徴とする請求項10に記載の通信装置。
  18. 18
    前記入出力ユニットは、更に、前記オーディオデータの最終セグメントを受信し、該オーディオデータの最終セグメントと同時又はそれより遅い時点で、前記オーディオデータの最終セグメントに論理的に関連する前記ビデオデータの最終セグメントを受信し、 前記プロセッサは、更に、前記オーディオデータの最終セグメントと前記ビデオデータの最終セグメントとが同期しないように、所定の速度より速い高再生速度で前記オーディオデータの最終セグメントを再生し、 前記ビデオデータの再生の終了前に、前記オーディオデータの再生を終了する ことを特徴とする請求項10に記載の通信装置。
Independent claims18