PL2068307T3

Enhanced coding and parameter representation of multichannel downmixed object coding

Abstract

An audio object coder for generating an encoded object signal using a plurality of audio objects includes a downmix information generator for generating downmix information indicating a distribution of the plurality of audio objects into at least two downmix channels, an audio object parameter generator for generating object parameters for the audio objects, and an output interface for generating the imported audio output signal using the downmix information and the object parameters. An audio synthesizer uses the downmix information for generating output data usable for creating a plurality of output channels of the predefined audio output configuration.

PL2068307T3, drawing sheet 1
Sheet 1 of 16

Term

1 yearto projected expiry

Projected expiry 5 October 2027, counted from filing; an application has no term until it is granted.

  1. Priority
  2. Filed
  3. Published
  4. Today
  5. Projected expiry

1 claim: 1 independent, 0 dependent

  1. 1
    Zastrzeżenia claim 1. An audio synthesizer (104) for generating output data using a coded audio object signal (95, 97), comprising:1. Syntezator audio (104) do generowania danych wyjściowych przy użyciu kodowanego sygnału obiektów audio (95, 97), obejmuj ący: an output data synthesizer (100) for generating output data useful for rendering multiple output channels of a predefined audio output configuration, representing multiple audio objects, an output data synthesizer used to use downmix information, indicating the distribution of multiple audio objects in at least two downmix channels, information about power, correlation information, indicating power characteristics and correlation characteristics of at least two downmix channels (93) and audio object parameters for audio objects, where the output data synthesizer (100) is used to transcode (502) parameters of audio objects to spatial parameters for a predefined configuration output audio using the additionally intended audio object setting (90) in the audio output configuration. syntezator danych wyjściowych (100) do generowania danych wyjściowych, przydatnych do renderowania wielu kanałów wyjściowych predefiniowanej konfiguracji wyjściowej audio, reprezentującej wiele obiektów audio, syntezator danych wyjściowych używany do wykorzystywania informacji downmiksu, wskazujących rozkład wielu obiektów audio w co najmniej dwóch kanałach downmiksu, informacje o mocy, informacje korelacji, wskazujące charakterystyki mocy i charakterystyki korelacji co najmniej dwóch kanałów downmiksu (93) oraz parametry obiektów audio dla obiektów audio, gdzie syntezator danych wyjściowych (100) jest używany do transkodowania (502) parametrów obiektów audio do parametrów przestrzennych dla predefiniowanej konfiguracji wyjściowej audio przy wykorzystaniu dodatkowo zamierzonego ustawienia obiektów audio (90) w konfiguracji wyjściowej audio. 2. Syntezator audio według zastrzeżenia 1, w którym syntezator danych wyjściowych (100) jest używany do konwersji wielu kanałów downmiksu do downmiksu stereo dla predefiniowanej konfiguracji wyjściowej audio przy użyciu macierzy konwersji, wyprowadzonej z zamierzonego rozmieszczenia obiektów audio. 2. The audio synthesizer of claim 1, wherein the output data synthesizer (100) is used to convert multiple downmix channels to a stereo downmix for a predefined audio output configuration using a conversion matrix derived from the intended arrangement of the audio objects. 3. Syntezator audio według zastrzeżenia 1, w którym parametry przestrzenne obejmują pierwszą grupę parametrów dla up-miksu Two-To-Three i drugą grupę parametrów energii dla up-miksu Three-To-Six, oraz gdzie syntezator danych wyjściowych (100) jest używany do obliczania parametrów predykcji dla macierzy predykcji TwoTo-Three przy, użyciu macierzy renderu j ące j_,_ . określonej przez zamierzone rozmieszczenie obiektów audio (90) , macierzy częściowego downmiksu, opisującej downmiksowanie kanałów wyjściowych do trzech kanałów, generowanych przez hipotetyczny proces up-miksowania Two-To-Three, oraz macierzy downmiksu. 3. The audio synthesizer according to claim 1, wherein the spatial parameters comprise a first parameter group for a Two-To-Three upmix and a second energy parameter group for a Three-To-Six up-mix, and wherein the output data synthesizer (100) is used to calculate the prediction parameters for the TwoTo-Three matrix for using a matrix of rendering j _, _. determined by the intended arrangement of audio objects (90), a partial downmix matrix describing the downmixing of output channels to three channels, generated by a hypothetical Two-To-Three upmixing process, and a downmix matrix. 4. Syntezator audio według zastrzeżenia 3, w którym parametry obiektów są parametrami predykcji obiektów i gdzie syntezator danych wyjściowych (100) jest używany do wstępnego obliczania macierzy energii w oparciu o parametry predykcji obiektów, informacje downmiksu i informacje o energii, odpowiadające kanałom downmiksu. 4. The audio synthesizer of claim 3, wherein the object parameters are object prediction parameters and wherein the output data synthesizer (100) is used to pre-calculate the energy matrix based on the prediction parameters of the objects, downmix information and energy information corresponding to the downmix channels. 5. Syntezator audio według zastrzeżenia 1, w którym syntezator danych wyjściowych (100) jest używany do generowania (165) dwóch kanałów stereo dla konfiguracji wyjściowej stereo poprzez obliczanie parametryzowanej macierzy renderującej stereo i macierzy konwersji, zależnej od parametryzowanej macierzy renderującej stereo. The audio synthesizer of claim 1, wherein the output data synthesizer (100) is used to generate (165) two stereo channels for a stereo output configuration by calculating a parameterized stereo rendering matrix and a conversion matrix depending on the parameterized stereo rendering matrix. 6. A method of audio synthesis for generating output data using a coded audio object signal (95, 97), comprising: 6. Sposób syntezy audio do generowania danych wyjściowych przy użyciu kodowanego sygnału obiektów audio (95, 97), obej muj ąca: generating output data useful for creating multiple output channels of a predefined audio output configuration representing multiple audio objects (90), where downmix information is used, indicating distribution of multiple audio objects in at least two downmix channels, power information, correlation information, indicative characteristics the power and correlation characteristics of at least two downmix channels (93) and the parameters where the downmix generator (96) is 150) information about the power of audio objects for audio objects, and where audio object parameters are transcoded (502) to spatial parameters for a predefined audio output configuration using additional object settings, audio (90) in the audio output configuration. .... generowanie danych wyjściowych, przydatnych do tworzenia wielu kanałów wyjściowych predefiniowanej konfiguracji wyjściowej audio, reprezentującej wiele obiektów audio (90), gdzie używane są informacje downmiksu, wskazujące rozkład wielu obiektów audio w co najmniej dwóch kanałach downmiksu, informacje o mocy, informacje korelacji, wskazujące charakterystyki mocy i charakterystyki korelacji co najmniej dwóch kanałów downmiksu (93) oraz parametry gdzie generator downmiksu (96) jest 150) informacji o mocy obiektów audio dla obiektów audio, i gdzie parametry obiektów audio są transkodowane (502) do parametrów przestrzennych dla predefiniowanej konfiguracji wyjściowej audio przy wykorzystaniu dodatkowo zamierzonego ustawienia obiektów, audio (90) w konfiguracji wyjściowej ..audio. .. . 7. An audio object coder (101) for generating a coded audio object signal using a plurality of audio objects (90), comprising: 7. Koder obiektów audio (101) do generowania kodowanego sygnału obiektów audio przy użyciu wielu obiektów audio (90), obejmujący: a downmix information generator (96) for generating downmix information (97), indicating the distribution of multiple audio objects in at least two downmix channels, information configured to generate and correlation information, indicating power characteristics and correlation characteristics of at least two downmix channels (93) ;generator informacji downmiksu (96) do generowania informacji downmiksu (97), wskazujących rozkład wielu obiektów audio w co najmniej dwóch kanałach downmiksu, informacj i skonfigurowany do generowania i informacji o korelacji, wskazujących charakterystyki mocy i charakterystyki korelacji co najmniej dwóch kanałów downmiksu (93);an object parameter generator (94) for generating object parameters (95) for audio objects;and an output interface (98) for generating a coded signal (99) of audio objects, wherein the encoded object signal includes downmix information, power information, correlation information, and object parameters. generator parametrów obiektów (94) do generowania parametrów obiektów (95) dla obiektów audio;oraz interfejs wyjściowy (98) do generowania kodowanego sygnału (99) obiektów audio, gdzie kodowany sygnał obiektów obejmuje informacje downmiksu, informacje o mocy, informacje o korelacji i parametry obiektów. 8. Koder obiektów audio według zastrzeżenia 7, obejmujący poza tym: The audio object coder according to claim 7, further comprising: downmikser (92) do downmiksowanie wielu obiektów audio do wielu kanałów downmiksu, gdzie ilość obiektów audio jest większa niż ilość kanałów downmiksu, i gdzie downmikser (92) jest powiązany z generatorem informacji downmiksu tak, że rozkład wielu obiektów audio w wielu kanałach downmiksu jest wykonywany zgodnie z informacjami downmiksu. downmixer (92) for downmixing multiple audio objects to a plurality of downmix channels, wherein the number of audio objects is greater than the number of downmix channels, and where the downmixer (92) is associated with the downmix information generator so that the distribution of multiple audio objects in the multiple downmix channels is performed according to the downmix information. 9. Koder obiektów audio według zastrzeżenia 7, gdzie generator informacji downmiksu (96) jest używany do obliczania informacji downmiksu tak, że informacje downmiksu wskazują, który obiekt audio jest całkowicie lub częściowo dołączony do jednego lub wielu kanałów downmiksu, oraz przy użyciu wielu wskazujących rozkład o mocy i inf ormac j i charakterystyki mocy gdy obiekt audio jest dołączony do więcej niż jednego kanału_ downmiksu, informacji dotyczących czę.ści obiektów audio, dołączonych do jednego kanału downmiksu z więcej niż jednego kanałów downmiksu. The audio object coder according to claim 7, wherein the downmix information generator (96) is used to calculate the downmix information such that the downmix information indicates which audio object is fully or partially attached to one or more downmix channels, and using a plurality of indicative distributions. with power and / or power characteristics when the audio object is connected to more than one downmix channel, information about a part of audio objects connected to one downmix channel from more than one downmix channel. 10. Sposób kodowania obiektów audio (101) do generowania kodowanego sygnału obiektów audio obiektów audio (90), obejmująca: generowanie informacji downmiksu (97), wielu obiektów audio (90) w co najmniej dwóch kanałach downmiksu, generowanie (150) informacji o korelacji, wskazujących i charakterystyki korelacji co najmniej dwóch kanałów downmiksu;A method for coding audio objects (101) for generating a coded audio object object signal (90), comprising: generating downmix information (97), multiple audio objects (90) in at least two downmix channels, generating (150) correlation information;, indicating and correlation characteristics of at least two downmix channels;generating object parameters (94) for audio objects;generowanie parametrów obiektów (94) dla obiektów audio;and generating a coded signal (99) of audio objects, wherein the encoded object signal includes downmix information, power information, correlation information, and object parameters. oraz generowanie kodowanego sygnału (99) obiektów audio, gdzie kodowany sygnał obiektów obejmuje informacje downmiksu, informacje o mocy, informacje o korelacji i parametry obiektów. 11. A coded audio object signal including downmix information indicative of the distribution of a plurality of audio objects in at least two downmix channels, power information and correlation information, indicating power characteristics and correlation characteristics of at least two downmix channels, and object parameters such that reproduction Audio objects are possible using object parameters and at least two downmix channels. 11. Kodowany sygnał obiektów audio, obejmujący informacje downmiksu, wskazujące rozkład wielu obiektów audio w co najmniej dwóch kanałach downmiksu, informacje o mocy i informacje o korelacji, wskazujące charakterystyki mocy i charakterystyki korelacji co najmniej dwóch kanałów downmiksu, oraz parametry obiektów takie, że odtwarzanie obiektów audio jest możliwe przy użyciu parametrów obiektów i co najmniej dwóch kanałów downmiksu. 12. Kodowany sygnał obiektów audio według zastrzeżenia 11, zapisany na nośniku odczytywanym przez komputer. 12. The encoded audio object signal according to claim 11, stored on a medium read by the computer. 13. A computer program for executing, when used on a computer, methods according to any one of claims 6 to 10. 13. Program komputerowy do wykonywania, podczas użycia w komputerze, metody według któregokolwiek z zastrzeżeń od 6 do 10. DOLBY INTERNATIONAL AB, Holandia DOLBY INTERNATIONAL AB, the Netherlands Pełnomocnik: Proxy: jtazewskj J Patentowy jtazewskj J Patentowy EP 2 068 ,-8945 EP 2 068, -8945 307 Bl 307 Bl N obiektów N objects Encoder parameters Parametry kodera Macierz renderującą Rendering matrix FIG1A Fig1 CO WHAT CD CD LL64 LL64 FIG 2 FIG 2 Encoder parameters Parametry kodera Γ I I y mjuci Γ II y mjuci F4 301 F4 301 302 .202 302.2202 304 304 mono (obiektów i mono (objects and Data grouping Grupowanie danych FIG 3 FIG 3 202 π 202 π FIG 4 FIG 4 102 102 FIG 5 FIG 5 Downmiks obiektów macierz konwertera Downmix objects of the converter matrix FIG 6 FIG 6 FIG 7 FIG 7 801 801 802 802 L L R obj5 R obj5 FIG 8 FIG 8 FIG 9 FIG 9 Audio synthesizer Syntezator audio predefined output configuration predefiniowanej konfiguracji wyjściowej FIG 10 FIG 10 ΊΊ ΊΊ '111 '111 -112 -112 113 113 114 114 115 115 116 116 FIG 11 FIG 11 FIG 12 FIG 12 CLD, cld2 CLD, cld2 ICC ICC, ICC2 ICC2 FIG 13A FIG 13A FIG 13B FIG 13B 142 / 142 / N obiektów N objects SS * = E SS*=E N> K> 2 N>K>2 K downmik channels 143 K kanałów downmiksu 143 X = DS \ X=DS \ M kanałów wyjściowych M output channels V = AS 1. V=A-S 1 . S ~ CX = CDS S~CX=CDS FIG 14 up-mikser przestrzenny FIG 14 up-spatial mixer 2 K prediction parameters of objects for reproducing sources by S «C» X 2K parametry predykcji obiektów do odtwarzania źródeł przez S«C»X FIG 15 (3 sources) 'μ G-μ) (1-κ) κ FIG 15 (3 źródła) ' μ G-μ) (1-κ) κ FIG 16 FIG 16