arm-optimized-routines/math/exp10.c

*412f47f9SXin Li/*
*412f47f9SXin Li * Double-precision 10^x function.
*412f47f9SXin Li *
*412f47f9SXin Li * Copyright (c) 2023-2024, Arm Limited.
*412f47f9SXin Li * SPDX-License-Identifier: MIT OR Apache-2.0 WITH LLVM-exception
*412f47f9SXin Li */
*412f47f9SXin Li
*412f47f9SXin Li#include "math_config.h"
*412f47f9SXin Li
*412f47f9SXin Li#define N (1 << EXP_TABLE_BITS)
*412f47f9SXin Li#define IndexMask (N - 1)
*412f47f9SXin Li#define OFlowBound 0x1.34413509f79ffp8 /* log10(DBL_MAX).  */
*412f47f9SXin Li#define UFlowBound -0x1.5ep+8 /* -350.  */
*412f47f9SXin Li#define SmallTop 0x3c6 /* top12(0x1p-57).  */
*412f47f9SXin Li#define BigTop 0x407   /* top12(0x1p8).  */
*412f47f9SXin Li#define Thresh 0x41    /* BigTop - SmallTop.  */
*412f47f9SXin Li#define Shift __exp_data.shift
*412f47f9SXin Li#define C(i) __exp_data.exp10_poly[i]
*412f47f9SXin Li
*412f47f9SXin Listatic double
*412f47f9SXin Lispecial_case (uint64_t sbits, double_t tmp, uint64_t ki)
*412f47f9SXin Li{
*412f47f9SXin Li  double_t scale, y;
*412f47f9SXin Li
*412f47f9SXin Li  if ((ki & 0x80000000) == 0)
*412f47f9SXin Li    {
*412f47f9SXin Li      /* The exponent of scale might have overflowed by 1.  */
*412f47f9SXin Li      sbits -= 1ull << 52;
*412f47f9SXin Li      scale = asdouble (sbits);
*412f47f9SXin Li      y = 2 * (scale + scale * tmp);
*412f47f9SXin Li      return check_oflow (eval_as_double (y));
*412f47f9SXin Li    }
*412f47f9SXin Li
*412f47f9SXin Li  /* n < 0, need special care in the subnormal range.  */
*412f47f9SXin Li  sbits += 1022ull << 52;
*412f47f9SXin Li  scale = asdouble (sbits);
*412f47f9SXin Li  y = scale + scale * tmp;
*412f47f9SXin Li
*412f47f9SXin Li  if (y < 1.0)
*412f47f9SXin Li    {
*412f47f9SXin Li      /* Round y to the right precision before scaling it into the subnormal
*412f47f9SXin Li	 range to avoid double rounding that can cause 0.5+E/2 ulp error where
*412f47f9SXin Li	 E is the worst-case ulp error outside the subnormal range.  So this
*412f47f9SXin Li	 is only useful if the goal is better than 1 ulp worst-case error.  */
*412f47f9SXin Li      double_t lo = scale - y + scale * tmp;
*412f47f9SXin Li      double_t hi = 1.0 + y;
*412f47f9SXin Li      lo = 1.0 - hi + y + lo;
*412f47f9SXin Li      y = eval_as_double (hi + lo) - 1.0;
*412f47f9SXin Li      /* Avoid -0.0 with downward rounding.  */
*412f47f9SXin Li      if (WANT_ROUNDING && y == 0.0)
*412f47f9SXin Li	y = 0.0;
*412f47f9SXin Li      /* The underflow exception needs to be signaled explicitly.  */
*412f47f9SXin Li      force_eval_double (opt_barrier_double (0x1p-1022) * 0x1p-1022);
*412f47f9SXin Li    }
*412f47f9SXin Li  y = 0x1p-1022 * y;
*412f47f9SXin Li
*412f47f9SXin Li  return check_uflow (y);
*412f47f9SXin Li}
*412f47f9SXin Li
*412f47f9SXin Li/* Double-precision 10^x approximation. Largest observed error is ~0.513 ULP.  */
*412f47f9SXin Lidouble
*412f47f9SXin Liexp10 (double x)
*412f47f9SXin Li{
*412f47f9SXin Li  uint64_t ix = asuint64 (x);
*412f47f9SXin Li  uint32_t abstop = (ix >> 52) & 0x7ff;
*412f47f9SXin Li
*412f47f9SXin Li  if (unlikely (abstop - SmallTop >= Thresh))
*412f47f9SXin Li    {
*412f47f9SXin Li      if (abstop - SmallTop >= 0x80000000)
*412f47f9SXin Li	/* Avoid spurious underflow for tiny x.
*412f47f9SXin Li	   Note: 0 is common input.  */
*412f47f9SXin Li	return x + 1;
*412f47f9SXin Li      if (abstop == 0x7ff)
*412f47f9SXin Li	return ix == asuint64 (-INFINITY) ? 0.0 : x + 1.0;
*412f47f9SXin Li      if (x >= OFlowBound)
*412f47f9SXin Li	return __math_oflow (0);
*412f47f9SXin Li      if (x < UFlowBound)
*412f47f9SXin Li	return __math_uflow (0);
*412f47f9SXin Li
*412f47f9SXin Li      /* Large x is special-cased below.  */
*412f47f9SXin Li      abstop = 0;
*412f47f9SXin Li    }
*412f47f9SXin Li
*412f47f9SXin Li  /* Reduce x: z = x * N / log10(2), k = round(z).  */
*412f47f9SXin Li  double_t z = __exp_data.invlog10_2N * x;
*412f47f9SXin Li  double_t kd;
*412f47f9SXin Li  uint64_t ki;
*412f47f9SXin Li#if TOINT_INTRINSICS
*412f47f9SXin Li  kd = roundtoint (z);
*412f47f9SXin Li  ki = converttoint (z);
*412f47f9SXin Li#else
*412f47f9SXin Li  kd = eval_as_double (z + Shift);
*412f47f9SXin Li  ki = asuint64 (kd);
*412f47f9SXin Li  kd -= Shift;
*412f47f9SXin Li#endif
*412f47f9SXin Li
*412f47f9SXin Li  /* r = x - k * log10(2), r in [-0.5, 0.5].  */
*412f47f9SXin Li  double_t r = x;
*412f47f9SXin Li  r = __exp_data.neglog10_2hiN * kd + r;
*412f47f9SXin Li  r = __exp_data.neglog10_2loN * kd + r;
*412f47f9SXin Li
*412f47f9SXin Li  /* exp10(x) = 2^(k/N) * 2^(r/N).
*412f47f9SXin Li     Approximate the two components separately.  */
*412f47f9SXin Li
*412f47f9SXin Li  /* s = 2^(k/N), using lookup table.  */
*412f47f9SXin Li  uint64_t e = ki << (52 - EXP_TABLE_BITS);
*412f47f9SXin Li  uint64_t i = (ki & IndexMask) * 2;
*412f47f9SXin Li  uint64_t u = __exp_data.tab[i + 1];
*412f47f9SXin Li  uint64_t sbits = u + e;
*412f47f9SXin Li
*412f47f9SXin Li  double_t tail = asdouble (__exp_data.tab[i]);
*412f47f9SXin Li
*412f47f9SXin Li  /* 2^(r/N) ~= 1 + r * Poly(r).  */
*412f47f9SXin Li  double_t r2 = r * r;
*412f47f9SXin Li  double_t p = C (0) + r * C (1);
*412f47f9SXin Li  double_t y = C (2) + r * C (3);
*412f47f9SXin Li  y = y + r2 * C (4);
*412f47f9SXin Li  y = p + r2 * y;
*412f47f9SXin Li  y = tail + y * r;
*412f47f9SXin Li
*412f47f9SXin Li  if (unlikely (abstop == 0))
*412f47f9SXin Li    return special_case (sbits, y, ki);
*412f47f9SXin Li
*412f47f9SXin Li  /* Assemble components:
*412f47f9SXin Li     y  = 2^(r/N) * 2^(k/N)
*412f47f9SXin Li       ~= (y + 1) * s.  */
*412f47f9SXin Li  double_t s = asdouble (sbits);
*412f47f9SXin Li  return eval_as_double (s * y + s);
*412f47f9SXin Li}