silk/fixed/burg_modified_FIX.c

*a58d3d2aSXin Li/***********************************************************************
*a58d3d2aSXin LiCopyright (c) 2006-2011, Skype Limited. All rights reserved.
*a58d3d2aSXin LiRedistribution and use in source and binary forms, with or without
*a58d3d2aSXin Limodification, are permitted provided that the following conditions
*a58d3d2aSXin Liare met:
*a58d3d2aSXin Li- Redistributions of source code must retain the above copyright notice,
*a58d3d2aSXin Lithis list of conditions and the following disclaimer.
*a58d3d2aSXin Li- Redistributions in binary form must reproduce the above copyright
*a58d3d2aSXin Linotice, this list of conditions and the following disclaimer in the
*a58d3d2aSXin Lidocumentation and/or other materials provided with the distribution.
*a58d3d2aSXin Li- Neither the name of Internet Society, IETF or IETF Trust, nor the
*a58d3d2aSXin Linames of specific contributors, may be used to endorse or promote
*a58d3d2aSXin Liproducts derived from this software without specific prior written
*a58d3d2aSXin Lipermission.
*a58d3d2aSXin LiTHIS SOFTWARE IS PROVIDED BY THE COPYRIGHT HOLDERS AND CONTRIBUTORS "AS IS"
*a58d3d2aSXin LiAND ANY EXPRESS OR IMPLIED WARRANTIES, INCLUDING, BUT NOT LIMITED TO, THE
*a58d3d2aSXin LiIMPLIED WARRANTIES OF MERCHANTABILITY AND FITNESS FOR A PARTICULAR PURPOSE
*a58d3d2aSXin LiARE DISCLAIMED. IN NO EVENT SHALL THE COPYRIGHT OWNER OR CONTRIBUTORS BE
*a58d3d2aSXin LiLIABLE FOR ANY DIRECT, INDIRECT, INCIDENTAL, SPECIAL, EXEMPLARY, OR
*a58d3d2aSXin LiCONSEQUENTIAL DAMAGES (INCLUDING, BUT NOT LIMITED TO, PROCUREMENT OF
*a58d3d2aSXin LiSUBSTITUTE GOODS OR SERVICES; LOSS OF USE, DATA, OR PROFITS; OR BUSINESS
*a58d3d2aSXin LiINTERRUPTION) HOWEVER CAUSED AND ON ANY THEORY OF LIABILITY, WHETHER IN
*a58d3d2aSXin LiCONTRACT, STRICT LIABILITY, OR TORT (INCLUDING NEGLIGENCE OR OTHERWISE)
*a58d3d2aSXin LiARISING IN ANY WAY OUT OF THE USE OF THIS SOFTWARE, EVEN IF ADVISED OF THE
*a58d3d2aSXin LiPOSSIBILITY OF SUCH DAMAGE.
*a58d3d2aSXin Li***********************************************************************/
*a58d3d2aSXin Li
*a58d3d2aSXin Li#ifdef HAVE_CONFIG_H
*a58d3d2aSXin Li#include "config.h"
*a58d3d2aSXin Li#endif
*a58d3d2aSXin Li
*a58d3d2aSXin Li#include "SigProc_FIX.h"
*a58d3d2aSXin Li#include "define.h"
*a58d3d2aSXin Li#include "tuning_parameters.h"
*a58d3d2aSXin Li#include "pitch.h"
*a58d3d2aSXin Li
*a58d3d2aSXin Li#define MAX_FRAME_SIZE              384             /* subfr_length * nb_subfr = ( 0.005 * 16000 + 16 ) * 4 = 384 */
*a58d3d2aSXin Li
*a58d3d2aSXin Li#define QA                          25
*a58d3d2aSXin Li#define N_BITS_HEAD_ROOM            3
*a58d3d2aSXin Li#define MIN_RSHIFTS                 -16
*a58d3d2aSXin Li#define MAX_RSHIFTS                 (32 - QA)
*a58d3d2aSXin Li
*a58d3d2aSXin Li/* Compute reflection coefficients from input signal */
*a58d3d2aSXin Livoid silk_burg_modified_c(
*a58d3d2aSXin Li    opus_int32                  *res_nrg,           /* O    Residual energy                                             */
*a58d3d2aSXin Li    opus_int                    *res_nrg_Q,         /* O    Residual energy Q value                                     */
*a58d3d2aSXin Li    opus_int32                  A_Q16[],            /* O    Prediction coefficients (length order)                      */
*a58d3d2aSXin Li    const opus_int16            x[],                /* I    Input signal, length: nb_subfr * ( D + subfr_length )       */
*a58d3d2aSXin Li    const opus_int32            minInvGain_Q30,     /* I    Inverse of max prediction gain                              */
*a58d3d2aSXin Li    const opus_int              subfr_length,       /* I    Input signal subframe length (incl. D preceding samples)    */
*a58d3d2aSXin Li    const opus_int              nb_subfr,           /* I    Number of subframes stacked in x                            */
*a58d3d2aSXin Li    const opus_int              D,                  /* I    Order                                                       */
*a58d3d2aSXin Li    int                         arch                /* I    Run-time architecture                                       */
*a58d3d2aSXin Li)
*a58d3d2aSXin Li{
*a58d3d2aSXin Li    opus_int         k, n, s, lz, rshifts, reached_max_gain;
*a58d3d2aSXin Li    opus_int32       C0, num, nrg, rc_Q31, invGain_Q30, Atmp_QA, Atmp1, tmp1, tmp2, x1, x2;
*a58d3d2aSXin Li    const opus_int16 *x_ptr;
*a58d3d2aSXin Li    opus_int32       C_first_row[ SILK_MAX_ORDER_LPC ];
*a58d3d2aSXin Li    opus_int32       C_last_row[  SILK_MAX_ORDER_LPC ];
*a58d3d2aSXin Li    opus_int32       Af_QA[       SILK_MAX_ORDER_LPC ];
*a58d3d2aSXin Li    opus_int32       CAf[ SILK_MAX_ORDER_LPC + 1 ];
*a58d3d2aSXin Li    opus_int32       CAb[ SILK_MAX_ORDER_LPC + 1 ];
*a58d3d2aSXin Li    opus_int32       xcorr[ SILK_MAX_ORDER_LPC ];
*a58d3d2aSXin Li    opus_int64       C0_64;
*a58d3d2aSXin Li
*a58d3d2aSXin Li    celt_assert( subfr_length * nb_subfr <= MAX_FRAME_SIZE );
*a58d3d2aSXin Li
*a58d3d2aSXin Li    /* Compute autocorrelations, added over subframes */
*a58d3d2aSXin Li    C0_64 = silk_inner_prod16( x, x, subfr_length*nb_subfr, arch );
*a58d3d2aSXin Li    lz = silk_CLZ64(C0_64);
*a58d3d2aSXin Li    rshifts = 32 + 1 + N_BITS_HEAD_ROOM - lz;
*a58d3d2aSXin Li    if (rshifts > MAX_RSHIFTS) rshifts = MAX_RSHIFTS;
*a58d3d2aSXin Li    if (rshifts < MIN_RSHIFTS) rshifts = MIN_RSHIFTS;
*a58d3d2aSXin Li
*a58d3d2aSXin Li    if (rshifts > 0) {
*a58d3d2aSXin Li        C0 = (opus_int32)silk_RSHIFT64(C0_64, rshifts );
*a58d3d2aSXin Li    } else {
*a58d3d2aSXin Li        C0 = silk_LSHIFT32((opus_int32)C0_64, -rshifts );
*a58d3d2aSXin Li    }
*a58d3d2aSXin Li
*a58d3d2aSXin Li    CAb[ 0 ] = CAf[ 0 ] = C0 + silk_SMMUL( SILK_FIX_CONST( FIND_LPC_COND_FAC, 32 ), C0 ) + 1;                                /* Q(-rshifts) */
*a58d3d2aSXin Li    silk_memset( C_first_row, 0, SILK_MAX_ORDER_LPC * sizeof( opus_int32 ) );
*a58d3d2aSXin Li    if( rshifts > 0 ) {
*a58d3d2aSXin Li        for( s = 0; s < nb_subfr; s++ ) {
*a58d3d2aSXin Li            x_ptr = x + s * subfr_length;
*a58d3d2aSXin Li            for( n = 1; n < D + 1; n++ ) {
*a58d3d2aSXin Li                C_first_row[ n - 1 ] += (opus_int32)silk_RSHIFT64(
*a58d3d2aSXin Li                    silk_inner_prod16( x_ptr, x_ptr + n, subfr_length - n, arch ), rshifts );
*a58d3d2aSXin Li            }
*a58d3d2aSXin Li        }
*a58d3d2aSXin Li    } else {
*a58d3d2aSXin Li        for( s = 0; s < nb_subfr; s++ ) {
*a58d3d2aSXin Li            int i;
*a58d3d2aSXin Li            opus_int32 d;
*a58d3d2aSXin Li            x_ptr = x + s * subfr_length;
*a58d3d2aSXin Li            celt_pitch_xcorr(x_ptr, x_ptr + 1, xcorr, subfr_length - D, D, arch );
*a58d3d2aSXin Li            for( n = 1; n < D + 1; n++ ) {
*a58d3d2aSXin Li               for ( i = n + subfr_length - D, d = 0; i < subfr_length; i++ )
*a58d3d2aSXin Li                  d = MAC16_16( d, x_ptr[ i ], x_ptr[ i - n ] );
*a58d3d2aSXin Li               xcorr[ n - 1 ] += d;
*a58d3d2aSXin Li            }
*a58d3d2aSXin Li            for( n = 1; n < D + 1; n++ ) {
*a58d3d2aSXin Li                C_first_row[ n - 1 ] += silk_LSHIFT32( xcorr[ n - 1 ], -rshifts );
*a58d3d2aSXin Li            }
*a58d3d2aSXin Li        }
*a58d3d2aSXin Li    }
*a58d3d2aSXin Li    silk_memcpy( C_last_row, C_first_row, SILK_MAX_ORDER_LPC * sizeof( opus_int32 ) );
*a58d3d2aSXin Li
*a58d3d2aSXin Li    /* Initialize */
*a58d3d2aSXin Li    CAb[ 0 ] = CAf[ 0 ] = C0 + silk_SMMUL( SILK_FIX_CONST( FIND_LPC_COND_FAC, 32 ), C0 ) + 1;                                /* Q(-rshifts) */
*a58d3d2aSXin Li
*a58d3d2aSXin Li    invGain_Q30 = (opus_int32)1 << 30;
*a58d3d2aSXin Li    reached_max_gain = 0;
*a58d3d2aSXin Li    for( n = 0; n < D; n++ ) {
*a58d3d2aSXin Li        /* Update first row of correlation matrix (without first element) */
*a58d3d2aSXin Li        /* Update last row of correlation matrix (without last element, stored in reversed order) */
*a58d3d2aSXin Li        /* Update C * Af */
*a58d3d2aSXin Li        /* Update C * flipud(Af) (stored in reversed order) */
*a58d3d2aSXin Li        if( rshifts > -2 ) {
*a58d3d2aSXin Li            for( s = 0; s < nb_subfr; s++ ) {
*a58d3d2aSXin Li                x_ptr = x + s * subfr_length;
*a58d3d2aSXin Li                x1  = -silk_LSHIFT32( (opus_int32)x_ptr[ n ],                    16 - rshifts );        /* Q(16-rshifts) */
*a58d3d2aSXin Li                x2  = -silk_LSHIFT32( (opus_int32)x_ptr[ subfr_length - n - 1 ], 16 - rshifts );        /* Q(16-rshifts) */
*a58d3d2aSXin Li                tmp1 = silk_LSHIFT32( (opus_int32)x_ptr[ n ],                    QA - 16 );             /* Q(QA-16) */
*a58d3d2aSXin Li                tmp2 = silk_LSHIFT32( (opus_int32)x_ptr[ subfr_length - n - 1 ], QA - 16 );             /* Q(QA-16) */
*a58d3d2aSXin Li                for( k = 0; k < n; k++ ) {
*a58d3d2aSXin Li                    C_first_row[ k ] = silk_SMLAWB( C_first_row[ k ], x1, x_ptr[ n - k - 1 ]            ); /* Q( -rshifts ) */
*a58d3d2aSXin Li                    C_last_row[ k ]  = silk_SMLAWB( C_last_row[ k ],  x2, x_ptr[ subfr_length - n + k ] ); /* Q( -rshifts ) */
*a58d3d2aSXin Li                    Atmp_QA = Af_QA[ k ];
*a58d3d2aSXin Li                    tmp1 = silk_SMLAWB( tmp1, Atmp_QA, x_ptr[ n - k - 1 ]            );                 /* Q(QA-16) */
*a58d3d2aSXin Li                    tmp2 = silk_SMLAWB( tmp2, Atmp_QA, x_ptr[ subfr_length - n + k ] );                 /* Q(QA-16) */
*a58d3d2aSXin Li                }
*a58d3d2aSXin Li                tmp1 = silk_LSHIFT32( -tmp1, 32 - QA - rshifts );                                       /* Q(16-rshifts) */
*a58d3d2aSXin Li                tmp2 = silk_LSHIFT32( -tmp2, 32 - QA - rshifts );                                       /* Q(16-rshifts) */
*a58d3d2aSXin Li                for( k = 0; k <= n; k++ ) {
*a58d3d2aSXin Li                    CAf[ k ] = silk_SMLAWB( CAf[ k ], tmp1, x_ptr[ n - k ]                    );        /* Q( -rshift ) */
*a58d3d2aSXin Li                    CAb[ k ] = silk_SMLAWB( CAb[ k ], tmp2, x_ptr[ subfr_length - n + k - 1 ] );        /* Q( -rshift ) */
*a58d3d2aSXin Li                }
*a58d3d2aSXin Li            }
*a58d3d2aSXin Li        } else {
*a58d3d2aSXin Li            for( s = 0; s < nb_subfr; s++ ) {
*a58d3d2aSXin Li                x_ptr = x + s * subfr_length;
*a58d3d2aSXin Li                x1  = -silk_LSHIFT32( (opus_int32)x_ptr[ n ],                    -rshifts );            /* Q( -rshifts ) */
*a58d3d2aSXin Li                x2  = -silk_LSHIFT32( (opus_int32)x_ptr[ subfr_length - n - 1 ], -rshifts );            /* Q( -rshifts ) */
*a58d3d2aSXin Li                tmp1 = silk_LSHIFT32( (opus_int32)x_ptr[ n ],                    17 );                  /* Q17 */
*a58d3d2aSXin Li                tmp2 = silk_LSHIFT32( (opus_int32)x_ptr[ subfr_length - n - 1 ], 17 );                  /* Q17 */
*a58d3d2aSXin Li                for( k = 0; k < n; k++ ) {
*a58d3d2aSXin Li                    C_first_row[ k ] = silk_MLA( C_first_row[ k ], x1, x_ptr[ n - k - 1 ]            ); /* Q( -rshifts ) */
*a58d3d2aSXin Li                    C_last_row[ k ]  = silk_MLA( C_last_row[ k ],  x2, x_ptr[ subfr_length - n + k ] ); /* Q( -rshifts ) */
*a58d3d2aSXin Li                    Atmp1 = silk_RSHIFT_ROUND( Af_QA[ k ], QA - 17 );                                   /* Q17 */
*a58d3d2aSXin Li                    /* We sometimes get overflows in the multiplications (even beyond +/- 2^32),
*a58d3d2aSXin Li                       but they cancel each other and the real result seems to always fit in a 32-bit
*a58d3d2aSXin Li                       signed integer. This was determined experimentally, not theoretically (unfortunately). */
*a58d3d2aSXin Li                    tmp1 = silk_MLA_ovflw( tmp1, x_ptr[ n - k - 1 ],            Atmp1 );                      /* Q17 */
*a58d3d2aSXin Li                    tmp2 = silk_MLA_ovflw( tmp2, x_ptr[ subfr_length - n + k ], Atmp1 );                      /* Q17 */
*a58d3d2aSXin Li                }
*a58d3d2aSXin Li                tmp1 = -tmp1;                                                                           /* Q17 */
*a58d3d2aSXin Li                tmp2 = -tmp2;                                                                           /* Q17 */
*a58d3d2aSXin Li                for( k = 0; k <= n; k++ ) {
*a58d3d2aSXin Li                    CAf[ k ] = silk_SMLAWW( CAf[ k ], tmp1,
*a58d3d2aSXin Li                        silk_LSHIFT32( (opus_int32)x_ptr[ n - k ], -rshifts - 1 ) );                    /* Q( -rshift ) */
*a58d3d2aSXin Li                    CAb[ k ] = silk_SMLAWW( CAb[ k ], tmp2,
*a58d3d2aSXin Li                        silk_LSHIFT32( (opus_int32)x_ptr[ subfr_length - n + k - 1 ], -rshifts - 1 ) ); /* Q( -rshift ) */
*a58d3d2aSXin Li                }
*a58d3d2aSXin Li            }
*a58d3d2aSXin Li        }
*a58d3d2aSXin Li
*a58d3d2aSXin Li        /* Calculate nominator and denominator for the next order reflection (parcor) coefficient */
*a58d3d2aSXin Li        tmp1 = C_first_row[ n ];                                                                        /* Q( -rshifts ) */
*a58d3d2aSXin Li        tmp2 = C_last_row[ n ];                                                                         /* Q( -rshifts ) */
*a58d3d2aSXin Li        num  = 0;                                                                                       /* Q( -rshifts ) */
*a58d3d2aSXin Li        nrg  = silk_ADD32( CAb[ 0 ], CAf[ 0 ] );                                                        /* Q( 1-rshifts ) */
*a58d3d2aSXin Li        for( k = 0; k < n; k++ ) {
*a58d3d2aSXin Li            Atmp_QA = Af_QA[ k ];
*a58d3d2aSXin Li            lz = silk_CLZ32( silk_abs( Atmp_QA ) ) - 1;
*a58d3d2aSXin Li            lz = silk_min( 32 - QA, lz );
*a58d3d2aSXin Li            Atmp1 = silk_LSHIFT32( Atmp_QA, lz );                                                       /* Q( QA + lz ) */
*a58d3d2aSXin Li
*a58d3d2aSXin Li            tmp1 = silk_ADD_LSHIFT32( tmp1, silk_SMMUL( C_last_row[  n - k - 1 ], Atmp1 ), 32 - QA - lz );  /* Q( -rshifts ) */
*a58d3d2aSXin Li            tmp2 = silk_ADD_LSHIFT32( tmp2, silk_SMMUL( C_first_row[ n - k - 1 ], Atmp1 ), 32 - QA - lz );  /* Q( -rshifts ) */
*a58d3d2aSXin Li            num  = silk_ADD_LSHIFT32( num,  silk_SMMUL( CAb[ n - k ],             Atmp1 ), 32 - QA - lz );  /* Q( -rshifts ) */
*a58d3d2aSXin Li            nrg  = silk_ADD_LSHIFT32( nrg,  silk_SMMUL( silk_ADD32( CAb[ k + 1 ], CAf[ k + 1 ] ),
*a58d3d2aSXin Li                                                                                Atmp1 ), 32 - QA - lz );    /* Q( 1-rshifts ) */
*a58d3d2aSXin Li        }
*a58d3d2aSXin Li        CAf[ n + 1 ] = tmp1;                                                                            /* Q( -rshifts ) */
*a58d3d2aSXin Li        CAb[ n + 1 ] = tmp2;                                                                            /* Q( -rshifts ) */
*a58d3d2aSXin Li        num = silk_ADD32( num, tmp2 );                                                                  /* Q( -rshifts ) */
*a58d3d2aSXin Li        num = silk_LSHIFT32( -num, 1 );                                                                 /* Q( 1-rshifts ) */
*a58d3d2aSXin Li
*a58d3d2aSXin Li        /* Calculate the next order reflection (parcor) coefficient */
*a58d3d2aSXin Li        if( silk_abs( num ) < nrg ) {
*a58d3d2aSXin Li            rc_Q31 = silk_DIV32_varQ( num, nrg, 31 );
*a58d3d2aSXin Li        } else {
*a58d3d2aSXin Li            rc_Q31 = ( num > 0 ) ? silk_int32_MAX : silk_int32_MIN;
*a58d3d2aSXin Li        }
*a58d3d2aSXin Li
*a58d3d2aSXin Li        /* Update inverse prediction gain */
*a58d3d2aSXin Li        tmp1 = ( (opus_int32)1 << 30 ) - silk_SMMUL( rc_Q31, rc_Q31 );
*a58d3d2aSXin Li        tmp1 = silk_LSHIFT( silk_SMMUL( invGain_Q30, tmp1 ), 2 );
*a58d3d2aSXin Li        if( tmp1 <= minInvGain_Q30 ) {
*a58d3d2aSXin Li            /* Max prediction gain exceeded; set reflection coefficient such that max prediction gain is exactly hit */
*a58d3d2aSXin Li            tmp2 = ( (opus_int32)1 << 30 ) - silk_DIV32_varQ( minInvGain_Q30, invGain_Q30, 30 );            /* Q30 */
*a58d3d2aSXin Li            rc_Q31 = silk_SQRT_APPROX( tmp2 );                                                  /* Q15 */
*a58d3d2aSXin Li            if( rc_Q31 > 0 ) {
*a58d3d2aSXin Li                /* Newton-Raphson iteration */
*a58d3d2aSXin Li                rc_Q31 = silk_RSHIFT32( rc_Q31 + silk_DIV32( tmp2, rc_Q31 ), 1 );                       /* Q15 */
*a58d3d2aSXin Li                rc_Q31 = silk_LSHIFT32( rc_Q31, 16 );                                                   /* Q31 */
*a58d3d2aSXin Li                if( num < 0 ) {
*a58d3d2aSXin Li                    /* Ensure adjusted reflection coefficients has the original sign */
*a58d3d2aSXin Li                    rc_Q31 = -rc_Q31;
*a58d3d2aSXin Li                }
*a58d3d2aSXin Li            }
*a58d3d2aSXin Li            invGain_Q30 = minInvGain_Q30;
*a58d3d2aSXin Li            reached_max_gain = 1;
*a58d3d2aSXin Li        } else {
*a58d3d2aSXin Li            invGain_Q30 = tmp1;
*a58d3d2aSXin Li        }
*a58d3d2aSXin Li
*a58d3d2aSXin Li        /* Update the AR coefficients */
*a58d3d2aSXin Li        for( k = 0; k < (n + 1) >> 1; k++ ) {
*a58d3d2aSXin Li            tmp1 = Af_QA[ k ];                                                                  /* QA */
*a58d3d2aSXin Li            tmp2 = Af_QA[ n - k - 1 ];                                                          /* QA */
*a58d3d2aSXin Li            Af_QA[ k ]         = silk_ADD_LSHIFT32( tmp1, silk_SMMUL( tmp2, rc_Q31 ), 1 );      /* QA */
*a58d3d2aSXin Li            Af_QA[ n - k - 1 ] = silk_ADD_LSHIFT32( tmp2, silk_SMMUL( tmp1, rc_Q31 ), 1 );      /* QA */
*a58d3d2aSXin Li        }
*a58d3d2aSXin Li        Af_QA[ n ] = silk_RSHIFT32( rc_Q31, 31 - QA );                                          /* QA */
*a58d3d2aSXin Li
*a58d3d2aSXin Li        if( reached_max_gain ) {
*a58d3d2aSXin Li            /* Reached max prediction gain; set remaining coefficients to zero and exit loop */
*a58d3d2aSXin Li            for( k = n + 1; k < D; k++ ) {
*a58d3d2aSXin Li                Af_QA[ k ] = 0;
*a58d3d2aSXin Li            }
*a58d3d2aSXin Li            break;
*a58d3d2aSXin Li        }
*a58d3d2aSXin Li
*a58d3d2aSXin Li        /* Update C * Af and C * Ab */
*a58d3d2aSXin Li        for( k = 0; k <= n + 1; k++ ) {
*a58d3d2aSXin Li            tmp1 = CAf[ k ];                                                                    /* Q( -rshifts ) */
*a58d3d2aSXin Li            tmp2 = CAb[ n - k + 1 ];                                                            /* Q( -rshifts ) */
*a58d3d2aSXin Li            CAf[ k ]         = silk_ADD_LSHIFT32( tmp1, silk_SMMUL( tmp2, rc_Q31 ), 1 );        /* Q( -rshifts ) */
*a58d3d2aSXin Li            CAb[ n - k + 1 ] = silk_ADD_LSHIFT32( tmp2, silk_SMMUL( tmp1, rc_Q31 ), 1 );        /* Q( -rshifts ) */
*a58d3d2aSXin Li        }
*a58d3d2aSXin Li    }
*a58d3d2aSXin Li
*a58d3d2aSXin Li    if( reached_max_gain ) {
*a58d3d2aSXin Li        for( k = 0; k < D; k++ ) {
*a58d3d2aSXin Li            /* Scale coefficients */
*a58d3d2aSXin Li            A_Q16[ k ] = -silk_RSHIFT_ROUND( Af_QA[ k ], QA - 16 );
*a58d3d2aSXin Li        }
*a58d3d2aSXin Li        /* Subtract energy of preceding samples from C0 */
*a58d3d2aSXin Li        if( rshifts > 0 ) {
*a58d3d2aSXin Li            for( s = 0; s < nb_subfr; s++ ) {
*a58d3d2aSXin Li                x_ptr = x + s * subfr_length;
*a58d3d2aSXin Li                C0 -= (opus_int32)silk_RSHIFT64( silk_inner_prod16( x_ptr, x_ptr, D, arch ), rshifts );
*a58d3d2aSXin Li            }
*a58d3d2aSXin Li        } else {
*a58d3d2aSXin Li            for( s = 0; s < nb_subfr; s++ ) {
*a58d3d2aSXin Li                x_ptr = x + s * subfr_length;
*a58d3d2aSXin Li                C0 -= silk_LSHIFT32( silk_inner_prod_aligned( x_ptr, x_ptr, D, arch), -rshifts);
*a58d3d2aSXin Li            }
*a58d3d2aSXin Li        }
*a58d3d2aSXin Li        /* Approximate residual energy */
*a58d3d2aSXin Li        *res_nrg = silk_LSHIFT( silk_SMMUL( invGain_Q30, C0 ), 2 );
*a58d3d2aSXin Li        *res_nrg_Q = -rshifts;
*a58d3d2aSXin Li    } else {
*a58d3d2aSXin Li        /* Return residual energy */
*a58d3d2aSXin Li        nrg  = CAf[ 0 ];                                                                            /* Q( -rshifts ) */
*a58d3d2aSXin Li        tmp1 = (opus_int32)1 << 16;                                                                             /* Q16 */
*a58d3d2aSXin Li        for( k = 0; k < D; k++ ) {
*a58d3d2aSXin Li            Atmp1 = silk_RSHIFT_ROUND( Af_QA[ k ], QA - 16 );                                       /* Q16 */
*a58d3d2aSXin Li            nrg  = silk_SMLAWW( nrg, CAf[ k + 1 ], Atmp1 );                                         /* Q( -rshifts ) */
*a58d3d2aSXin Li            tmp1 = silk_SMLAWW( tmp1, Atmp1, Atmp1 );                                               /* Q16 */
*a58d3d2aSXin Li            A_Q16[ k ] = -Atmp1;
*a58d3d2aSXin Li        }
*a58d3d2aSXin Li        *res_nrg = silk_SMLAWW( nrg, silk_SMMUL( SILK_FIX_CONST( FIND_LPC_COND_FAC, 32 ), C0 ), -tmp1 );/* Q( -rshifts ) */
*a58d3d2aSXin Li        *res_nrg_Q = -rshifts;
*a58d3d2aSXin Li    }
*a58d3d2aSXin Li}