ES2467290T3

Audio decoder and decoding method using efficient downmixing

Abstract

A method that operates an audio decoder (200) to decode audio data that includes encoded blocks of Nn audio data channels to form decoded audio data including Mm decoded audio channels, M³, n being the number of channels of low frequency effects in the encoded audio data, and m being the number of channels of low frequency effects in the decoded audio data, the method comprising: - accept audio data that includes blocks of Nn channels of encoded audio data that have been encoded by an encoding method, including the coding method transform Nn channels of digital audio data and form and package exponent and mantissa data frequency domain; and - decode the accepted audio data, including decoding: - unpack and decode (403) the exponent data and frequency domain mantissa, - determine transform coefficients (605) from the exponent data and frequency domain mantissa unpacked and decoded, - submit a transformation Reverse (607) frequency domain data and apply additional processing to determine sampled audio data, and - mixing downwardly in the time domain (613) at least some blocks of the sampled audio data determined according to downstream mixing data for the case where M <N; wherein the downstream mixing in the time domain includes (1100) checking whether the downstream mixing data has changed over time with respect to previously used downstream mixing data, and, if they have changed, applying cross-damping to determine data of downstream mixing down and cross-mixing in the time domain according to cross-attenuated downward mixing data, and, if they have not changed, directly perform a downward mixing in the time domain according to the downstream mixing data.

ES2467290T3, drawing sheet 1
Sheet 1 of 13

Term

4.4 yearsto projected expiry

Projected expiry 17 February 2031, counted from filing; an application has no term until it is granted.

  1. Priority
  2. Filed
  3. Published
  4. Today
  5. Projected expiry

12 claims: 6 independent, 6 dependent

  1. 1
    REIVINDICACIONES 1.- Un método que hace funcionar un descodificador de audio (200) para descodificar datos de audio que incluyen bloques codificados de N.n canales de datos de audio para formar datos de audio descodificados que incluyen M.m 5 canales de audio descodificado, M≥1, siendo n el número de canales de efectos de baja frecuencia en los datos de audio codificados, y siendo m el número de canales de efectos de baja frecuencia en los datos de audio descodificados, comprendiendo el método:• aceptar los datos de audio que incluyen bloques de N.n canales de datos de audio codificados que han sido codificados mediante un método de codificación, incluyendo el método de codificación transformar N.n canales de datos de audio digital y formar y empaquetar datos de exponente y de mantisa de dominio de frecuencia;y • descodificar los datos de audio aceptados, incluyendo la descodificación: 15 - desempaquetar y descodificar (403) los datos de exponente y de mantisa de dominio de frecuencia, - determinar coeficientes de transformada (605) a partir de los datos de exponente y de mantisa de dominio de frecuencia desempaquetados y descodificados, - someter a una transformación inversa (607) los datos de dominio de frecuencia y aplicar un procesamiento adicional para determinar datos de audio muestreados, y - mezclar de manera descendente en el dominio de tiempo (613) al menos algunos bloques de los datos de audio muestreados determinados según datos de mezclado descendente para el caso en que M N;25 en el que el mezclado descendente en el dominio de tiempo incluye (1100) comprobar si los datos de mezclado descendente han cambiado en el tiempo con respecto a datos de mezclado descendente usados anteriormente, y , si han cambiado, aplicar una atenuación cruzada para determinar datos de mezclado descendente atenuados de manera cruzada y un mezclado descendente en el domino de tiempo según los datos de mezclado descendente atenuados de manera cruzada, y, si no han cambiado, realizar directamente un mezclado descendente en el dominio de tiempo según los datos de mezclado descendente.
  2. 2
    - El método según la reivindicación 1, donde el método incluye identificar (835) uno o más canales no contribuyentes de los N.n canales de entrada, siendo un canal no contribuyente un canal que no contribuye en los 35 M.m canales, y donde el método no lleva a cabo una transformación inversa de los datos de dominio de frecuencia ni aplica un procesamiento adicional en el uno o más canales no contribuyentes identificados.
  3. 3
    - El método según cualquiera de las reivindicaciones anteriores, en el que la transformación en el método de codificación usa una transformada solapada, y donde el procesamiento adicional incluye aplicar operaciones de división en ventanas y de solapamiento y suma (609) para determinar datos de audio muestreados.
  4. 4
    - El método según cualquiera de las reivindicaciones anteriores, en el que el método de codificación incluye formar y empaquetar metadatos relacionados con los datos de exponente y de mantisa de dominio de frecuencia, donde los metadatos incluyen opcionalmente metadatos relacionados con un procesamiento de pre-ruido transitorio y el 45 mezclado descendente.
  5. 5
    - El método según cualquiera de las reivindicaciones anteriores, en el que el descodificador (200) usa al menos un procesador x86 cuyo conjunto de instrucciones incluye difundir en flujo continuo extensiones (SSE) de una sola instrucción y múltiples datos que comprenden instrucciones vectoriales, y en el que el mezclado descendente en el dominio de tiempo incluye ejecutar instrucciones vectoriales en al menos un procesador del uno o más procesadores x86.
  6. 6
    - El método según la reivindicación 2, en el que n=1 y m=0, de manera que la transformación inversa y la aplicación de un procesamiento adicional no se llevan cabo en el canal de efecto de baja frecuencia. 55 7.- El método según la reivindicación 2, en el que los datos de audio que incluyen bloques codificados incluyen información que define el mezclado descendente, y en el que la identificación de uno o más canales no contribuyentes usa la información que define el mezclado descendente.
  7. 8
    - El método según la reivindicación 7, en el que la información que define el mezclado descendente incluye parámetros de nivel de mezclado que tienen valores predefinidos que indican que uno o más canales son canales no contribuyentes.
  8. 9
    - El método según la reivindicación 2, en el que la identificación de uno o más canales no contribuyentes incluye 65 además identificar si uno o más canales tienen una cantidad insignificante de contenido con respecto a uno o más otros canales, en el que la identificación de si uno o más canales tienen una cantidad insignificante de contenido con respecto a uno o más otros canales incluye comparar la diferencia de una medida de cantidad de contenido entre pares de canales con un umbral ajustable y/o en el que un canal tiene una cantidad insignificante de contenido con respecto a otro canal si su energía o nivel absoluto es al menos 15 dB inferior a los del otro canal o si su energía o nivel absoluto es al menos 18 dB inferior a los del otro canal o si su energía o nivel absoluto es al menos 25 dB 5 inferior a los del otro canal.
  9. 10
    - El método según cualquier reivindicación anterior, en el que los datos de audio aceptados están en forma de un flujo de bits de tramas de datos codificados, y en el que la descodificación se divide en un conjunto de operaciones de descodificación de sección de entrada (201) y en un conjunto de operaciones de descodificación de sección de 10 procesamiento (203), incluyendo las operaciones de descodificación de sección de entrada el desempaquetado y la descodificación de los datos de exponente y de mantisa de dominio de frecuencia de una trama del flujo de bits en datos de exponente y de mantisa de dominio de frecuencia desempaquetados y descodificados para la trama, y los metadatos incluidos en la trama, incluyendo las operaciones de descodificación de sección de procesamiento la determinación de los coeficientes de transformada, la transformación inversa y la aplicación de un procesamiento 15 adicional, la aplicación de cualquier procesamiento de pre-ruido transitorio requerido de descodificación y el mezclado descendente en el caso en que M N.
  10. 11
    - El método según la reivindicación 10, en el que las operaciones de descodificación de sección de entrada se llevan a cabo en una primera pasada seguida de una segunda pasada, comprendiendo la primera pasada 20 desempaquetar metadatos bloque a bloque y guardar punteros que apuntan a la ubicación en la que están almacenados los datos de exponente y de mantisa empaquetados, y comprendiendo la segunda pasada usar los punteros guardados que apuntan a los exponentes y mantisas empaquetados, y desempaquetar y descodificar datos de exponente y de mantisa canal a canal. 25 12.- El método según cualquier reivindicación anterior, en el que los datos de audio codificados se codifican según una norma del conjunto de normas que consiste en la norma AC-3, la norma E-AC-3 y la norma HE-AAC.
  11. 13
    - Un medio de almacenamiento legible por ordenador que almacena instrucciones de descodificación que cuando son ejecutadas por uno o más procesadores de un sistema de procesamiento hacen que el sistema de 30 procesamiento lleve a cabo el método de cualquiera de las reivindicaciones anteriores.
  12. 14
    - Un aparato (1200) que procesa datos de audio para descodificar los datos de audio que incluyen bloques codificados de N.n canales de datos de audio para formar datos de audio descodificados que incluyen M.m canales de audio descodificado, M≥1, siendo n el número de canales de efectos de baja frecuencia en los datos de audio 35 codificados, y siendo m el número de canales de efectos de baja frecuencia en los datos de audio descodificados, comprendiendo el aparato medios para llevar a cabo el método de cualquiera de las reivindicaciones 1 a 12.