ES2268340T3

Parametric multi-channel audio representation

Abstract

A method for encoding a multi-channel audio signal, comprising at least two audio channels (RI, LI), such that the method comprises generating (1) an audio signal (SC "single channel") of a single channel, comprising a particular combination of the at least two audio channels (RI, LI), and encoding the single channel audio signal (SC) into a bit stream (EBS), as an audio signal from single coded channel (ESC), generate (2) information (INF) from the at least two audio channels (RI, LI), which allows to recover, with a required quality level, the multi-channel audio signal from the audio signal of single channel (SC) and information (INF), so that the generation (2) of the information comprises: - determine (2) a first portion of the information (P1), which consists of a single set of parameters (S1), determined for a first frequency zone (FR1) of the multi-channel audio signal, and encode it for the first portion of the information (P1) in the current bits (EBS), as a first coded portion of the information (EIN ¿encoded information), and - determining (2) a second portion of the information (P2) for a second frequency zone (FR2) of the multi-channel audio signal, such that the second frequency zone (FR2) is a portion of the first frequency zone (FR1), and encode the second portion of the information (P2) within the bit stream (EBS), as a second encoded portion of the information (EIN).

ES2268340T3, drawing sheet 1
Sheet 1 of 4

Term

Term ended

Projected expiry passed 22 April 2023, 3.4 years ago.

  1. Priority
  2. Filed
  3. Published
  4. Projected expiry
  5. Today

20 claims: 3 independent, 17 dependent

  1. 1
    ES 2 268 340 T3 REIVINDICACIONES 1. Un método para codificar una señal de audio de múltiples canales, que comprende al menos dos canales de audio (RI, LI), de tal forma que el método comprende generar (1) una señal de audio (SC -“single channel”) de un único canal, que comprende una combinación particular de los al menos dos canales de audio (RI, LI), y codificar la señal de audio de canal único (SC) en una corriente de bits (EBS), como una señal de audio de canal único codificada (ESC), generar (2) información (INF) a partir de los al menos dos canales de audio (RI, LI), que permite recuperar, con un nivel de calidad requerido, la señal de audio de múltiples canales a partir de la señal de audio de canal único (SC) y de la información (INF), de tal modo que la generación (2) de la información comprende:- determinar (2) una primera porción de la información (P1), que consiste en un único conjunto de parámetros (S1), determinados para una primera zona de frecuencias (FR1) de la señal de audio de múltiples canales, y codificar la primera porción de la información (P1) en la corriente bits (EBS), como una primera porción codificada de la información (EIN -“encoded information”), y - determinar (2) una segunda porción de la información (P2) para una segunda zona de frecuencias (FR2) de la señal de audio de múltiples canales, de tal modo que la segunda zona de frecuencias (FR2) es una porción de la primera zona de frecuencias (FR1), y codificar la segunda porción de la información (P2) dentro de la corriente de bits (EBS), como una segunda porción codificada de la información (EIN).
  2. 2
    Un método para codificar una señal de audio de múltiples canales, de acuerdo con la reivindicación 1, que comprende adicionalmente:determinar únicamente (2) la segunda porción de la información (P2) para la segunda zona de frecuencias (FR2) de la señal de audio de múltiples canales en el caso de que una velocidad de bits de la señal de audio de múltiples canales codificada, que comprende la señal de audio de canal único (SC), la primera porción de la información (P1) y la segunda porción de la información (P2), no sea superior a una velocidad de bits máxima permisible (MBR).
  3. 3
    Un método de codificación de acuerdo con la reivindicación 1, caracterizado porque la información (INF) comprende conjuntos de parámetros (S1, S2,...), la primera porción (P1) comprende al menos un primero (S1) de los conjuntos de parámetros (S1, S2,...), y la segunda porción (P2) comprende al menos un segundo (S2) de los conjuntos de parámetros (S1, S2,...), de tal manera que cada conjunto de parámetros está asociado con una zona de frecuencias correspondiente (FR1, FR2,...).
  4. 4
    Un método de codificación de acuerdo con la reivindicación 3, caracterizado porque los conjuntos de parámetros comprenden al menos una indicación de localización (ILD, ITD, IPD, IC).
  5. 5
    Un método de codificación de acuerdo con la reivindicación 4, caracterizado porque la al menos una indicación de localización (ILD, ITD, IPD, IC) se selecciona de entre:una diferencia de niveles inter-auditivos o entre los dos oídos (ILD -“interaural level difference”), una diferencia de tiempos o de fases inter-auditivas, o entre los dos oídos (ITD -“interaural time difference”-, IPD -“interaural phase difference”), o una correlación transversal inter-auditiva, o entre los dos oídos (IC -“interaural cross-correlation”).
  6. 6
    Un método de codificación de acuerdo con la reivindicación 1 ó la reivindicación 2, caracterizado porque la primera zona de frecuencias (FR1) cubre una anchura banda completa (FBW -“full bandwidth”) de la señal de audio de múltiples canales.
  7. 7
    Un método de codificación de acuerdo con la reivindicación 1, caracterizado porque la primera zona de frecuencias (FR1) cubre sustancialmente una anchura de banda completa (FBW) de la señal de audio de múltiples canales, la segunda zona de frecuencias (FR2) cubre una porción de la anchura de banda completa (FBW), y por que determinar (2) la segunda porción de la información (P2) está destinada a determinar conjuntos de parámetros (S2, S3, ...) tanto para la segunda zona de frecuencias (FR2) como para el conjunto de zonas de frecuencias adicionales (FR3, FR4, FR5), de tal manera que la segunda zona de frecuencias (FR2) y el conjunto de zonas de frecuencias adicionales (FR3, FR4, FR5) cubren sustancialmente la anchura de banda completa (FBW), donde el conjunto de zonas de frecuencias adicionales (FR3, FR4, FR5) comprende al menos una zona de frecuencias adicional (FR3).
  8. 8
    Un método de codificación de acuerdo con la reivindicación 7, caracterizado porque la señal de audio de canal único (SC) y la primera porción (P1) de la información (INF) forman una capa de base de información (BL -“base layer”) que está siempre presente en la señal de audio de múltiples canales codificada (EBS), y porque el método comprende recibir (2) una velocidad de bits máxima permisible (MBR -“maximum bit rate”) de la señal de audio de múltiples canales codificada (EBS), de tal modo que la segunda porción de la información (P2) forma una capa de mejora de información (EL -“enhancement layer”) que es codificada únicamente si la velocidad de bits de la capa de base codificada (DL) y de la capa de mejora (EL) no es más alta que la velocidad de bits máxima permisible (MBR). ES 2 268 340 T3
  9. 9
    Un método de codificación de acuerdo con la reivindicación 3, caracterizado porque determinar (2) la primera porción de información (P1) en una trama particular (F2) de información codificada (EiN) comprende determinar (2) el primero de los conjuntos de parámetros (S1') contenido en la trama particular (F2), y codificar el primero de los conjuntos de parámetros (S1') basándose en el primero de los conjuntos de parámetros (S1) de una trama (F1) que precede a la trama particular (F2).
  10. 10
    Un método de codificación de acuerdo con la reivindicación 7, caracterizado porque determinar (2) la segunda porción de información (P2) contenida en una trama particular (F2) de la información codificada (EIN) comprende determinar (2) los conjuntos de parámetros (S2', S3', ...) de la segunda porción (P2) contenida en la trama particular (F2), y codificar los conjuntos de parámetros (S2', S3',...) de la segunda porción (P2) contenida en la trama particular (F2) basándose en los conjuntos de parámetros (S2, S3,...) de una trama (F1) que precede a la trama particular (F2).
  11. 11
    Un método de codificación de acuerdo con la reivindicación 7, caracterizado porque determinar (2) la segunda porción de información (P2) contenida en una trama particular (F2) de la información codificada (EIN) comprende determinar (2) los conjuntos de parámetros (S2', S3', ...) de la segunda porción (P2) contenida en la trama particular (F2), y codificar los conjuntos de parámetros (S2', S3',...) de la segunda porción (P2) contenida en la trama particular (F2) basándose en el primero de los conjuntos de parámetros (S1) de una trama (F1) que precede a la trama particular (F2).
  12. 12
    El método de codificación de acuerdo con una cualquiera de las reivindicaciones 9 a 11, caracterizado porque determinar (2) comprende calcular una diferencia entre los parámetros correspondientes de la trama particular (F2) y de la trama (F1) que precede a la trama particular (F2).
  13. 13
    Un codificador para codificar una señal de audio de múltiples canales que comprende al menos canales de audio (RI, LI), de tal modo que el codificador comprende:medios para generar (1) una señal de audio (SC -“single channel”) de un único canal, que comprende una combinación particular de los al menos dos canales de audio (RI, LI), medios para generar (2) información (INF) a partir de los al menos dos canales de audio (RI, LI), que permite recuperar, con un nivel de calidad requerido, la señal de audio de múltiples canales a partir de la señal de audio de canal único (SC) y de la información (INF), de tal modo que los medios para generar (2) la información comprenden: - medios para determinar (2) una primera porción de la información (P1), que consiste en un único conjunto de parámetros (S1), determinados para una primera zona de frecuencias (FR1) de la señal de audio de múltiples canales, y - medios para determinar (2) una segunda porción de la información (P2) para una segunda zona de frecuencias (FR2) de la señal de audio de múltiples canales, de tal modo que la segunda zona de frecuencias (FR2) es una porción de la primera zona de frecuencias (FR1).
  14. 14
    Un codificador para codificar una señal de audio de múltiples canales, de acuerdo con la reivindicación 13, que comprende adicionalmente medios para determinar (2) únicamente la segunda porción de la información (P2) para la segunda zona de frecuencias (FR2) de la señal de audio de múltiples canales, en el caso de que una velocidad de bits de la señal de audio de múltiples canales codificada, que comprende la señal de audio de canal único (SC), la primera porción de la información (P1) y la segunda porción de la información (P2), no sea superior a una velocidad de bits máxima permisible (MBR -“maximum bit rate”).
  15. 15
    Un aparato para suministrar una señal de audio, de tal modo que el aparato comprende:una entrada para recibir una señal de audio de múltiples canales, un codificador de acuerdo con la reivindicación 13 ó la reivindicación 14, destinado a codificar la señal de audio de múltiples canales con el fin de obtener una señal de audio de múltiples canales codificada, y una salida para suministrar la señal de audio de múltiples canales codificada.
  16. 16
    Una señal de audio de múltiples canales codificada, que comprende:una señal de audio (SC -“single channel”) de un único canal, que comprende una combinación particular de al menos dos canales de audio (RI, LI), e información (INF) procedente de los al menos dos canales de audio (RI, LI), lo que permite recuperar, con un nivel de calidad requerido, la señal de audio de múltiples canales a partir de la señal de audio de canal único (SC), y de la información (INF), de tal modo que la información comprende: - una primera porción de la información (P1), que consiste en un único conjunto de parámetros (S1) determinados para una primera zona de frecuencias (FR1) de la señal de audio de múltiples canales, y ES 2 268 340 T3 - una segunda porción de la información (P2) para una segunda zona de frecuencias (FR2) de la señal de audio de múltiples canales, de tal modo que la segunda zona de frecuencias (FR2) es una porción de la primera zona de frecuencias (FR1).
  17. 17
    Un medio de almacenamiento en el que se ha almacenado la señal de audio codificada de acuerdo con la reivindicación 16.
  18. 18
    Un método de descodificación de una señal de audio de múltiples canales codificada que se ha codificado de acuerdo con la reivindicación 16, de tal modo que el método de descodificación comprende:obtener (6, 7) una señal de audio de un único canal descodificada (SCO), que comprende una combinación particular de los al menos dos canales de audio (RI, LI), obtener (6, 8) información descodificada (INO) a partir de la información (INF), lo que permite recuperar la señal de audio de múltiples canales a partir de la señal de audio de canal único descodificada (SCO) y de la información descodificada (INO), de tal modo que la información descodificada (INO) comprende la primera porción de la información (P1) y la segunda porción de la información (P2), y aplicar (9), bien la primera porción de la información (P1) o bien la primera porción (P1) y la segunda porción de la información (P2) en la señal de audio de canal único (SCO) con el fin de generar una señal de audio de múltiples canales descodificada (LO, RO).
  19. 19
    Un descodificador para descodificar una señal de audio de múltiples canales codificada, la cual ha sido codificada de acuerdo con la reivindicación 16, de tal modo que el descodificador comprende:medios para obtener (6, 7) una señal de audio de un único canal descodificada (SCO), que comprende una combinación particular de los al menos dos canales de audio (RI, LI), medios para obtener (6, 8) información descodificada (INO) a partir de la información (INF), lo que permite recuperar la señal de audio de múltiples canales a partir de la señal de audio de canal único descodificada (SCO) y de la información descodificada (INO), de tal modo que la información descodificada (INO) comprende la primera porción de la información (P1) y la segunda porción de la información (P2), y medios para aplicar (9) la primera porción de la información (P1) y la segunda porción de la información (P2) en la señal de audio de canal único (SCO) con el fin de generar una señal de audio de múltiples canales descodificada (LO, RO).
  20. 20
    Un aparato para suministrar una señal de audio descodificada, de tal modo que el aparato comprende:una entrada para recibir una señal de audio de múltiples canales codificada, un descodificador de acuerdo con la reivindicación 19, destinado a descodificar la señal de audio de múltiples canales codificada, con el fin de obtener una señal de salida de múltiples canales, y una salida para suministrar o reproducir la señal de salida de múltiples canales.
Independent claims20