pl/math/sv_math.h

*412f47f9SXin Li/*
*412f47f9SXin Li * Wrapper functions for SVE ACLE.
*412f47f9SXin Li *
*412f47f9SXin Li * Copyright (c) 2019-2023, Arm Limited.
*412f47f9SXin Li * SPDX-License-Identifier: MIT OR Apache-2.0 WITH LLVM-exception
*412f47f9SXin Li */
*412f47f9SXin Li
*412f47f9SXin Li#ifndef SV_MATH_H
*412f47f9SXin Li#define SV_MATH_H
*412f47f9SXin Li
*412f47f9SXin Li#ifndef WANT_VMATH
*412f47f9SXin Li/* Enable the build of vector math code.  */
*412f47f9SXin Li# define WANT_VMATH 1
*412f47f9SXin Li#endif
*412f47f9SXin Li
*412f47f9SXin Li#if WANT_VMATH
*412f47f9SXin Li
*412f47f9SXin Li# include <arm_sve.h>
*412f47f9SXin Li# include <stdbool.h>
*412f47f9SXin Li
*412f47f9SXin Li# include "math_config.h"
*412f47f9SXin Li
*412f47f9SXin Li/* Double precision.  */
*412f47f9SXin Listatic inline svint64_t
*412f47f9SXin Lisv_s64 (int64_t x)
*412f47f9SXin Li{
*412f47f9SXin Li  return svdup_s64 (x);
*412f47f9SXin Li}
*412f47f9SXin Li
*412f47f9SXin Listatic inline svuint64_t
*412f47f9SXin Lisv_u64 (uint64_t x)
*412f47f9SXin Li{
*412f47f9SXin Li  return svdup_u64 (x);
*412f47f9SXin Li}
*412f47f9SXin Li
*412f47f9SXin Listatic inline svfloat64_t
*412f47f9SXin Lisv_f64 (double x)
*412f47f9SXin Li{
*412f47f9SXin Li  return svdup_f64 (x);
*412f47f9SXin Li}
*412f47f9SXin Li
*412f47f9SXin Listatic inline svfloat64_t
*412f47f9SXin Lisv_call_f64 (double (*f) (double), svfloat64_t x, svfloat64_t y, svbool_t cmp)
*412f47f9SXin Li{
*412f47f9SXin Li  svbool_t p = svpfirst (cmp, svpfalse ());
*412f47f9SXin Li  while (svptest_any (cmp, p))
*412f47f9SXin Li    {
*412f47f9SXin Li      double elem = svclastb (p, 0, x);
*412f47f9SXin Li      elem = (*f) (elem);
*412f47f9SXin Li      svfloat64_t y2 = sv_f64 (elem);
*412f47f9SXin Li      y = svsel (p, y2, y);
*412f47f9SXin Li      p = svpnext_b64 (cmp, p);
*412f47f9SXin Li    }
*412f47f9SXin Li  return y;
*412f47f9SXin Li}
*412f47f9SXin Li
*412f47f9SXin Listatic inline svfloat64_t
*412f47f9SXin Lisv_call2_f64 (double (*f) (double, double), svfloat64_t x1, svfloat64_t x2,
*412f47f9SXin Li	      svfloat64_t y, svbool_t cmp)
*412f47f9SXin Li{
*412f47f9SXin Li  svbool_t p = svpfirst (cmp, svpfalse ());
*412f47f9SXin Li  while (svptest_any (cmp, p))
*412f47f9SXin Li    {
*412f47f9SXin Li      double elem1 = svclastb (p, 0, x1);
*412f47f9SXin Li      double elem2 = svclastb (p, 0, x2);
*412f47f9SXin Li      double ret = (*f) (elem1, elem2);
*412f47f9SXin Li      svfloat64_t y2 = sv_f64 (ret);
*412f47f9SXin Li      y = svsel (p, y2, y);
*412f47f9SXin Li      p = svpnext_b64 (cmp, p);
*412f47f9SXin Li    }
*412f47f9SXin Li  return y;
*412f47f9SXin Li}
*412f47f9SXin Li
*412f47f9SXin Listatic inline svuint64_t
*412f47f9SXin Lisv_mod_n_u64_x (svbool_t pg, svuint64_t x, uint64_t y)
*412f47f9SXin Li{
*412f47f9SXin Li  svuint64_t q = svdiv_x (pg, x, y);
*412f47f9SXin Li  return svmls_x (pg, x, q, y);
*412f47f9SXin Li}
*412f47f9SXin Li
*412f47f9SXin Li/* Single precision.  */
*412f47f9SXin Listatic inline svint32_t
*412f47f9SXin Lisv_s32 (int32_t x)
*412f47f9SXin Li{
*412f47f9SXin Li  return svdup_s32 (x);
*412f47f9SXin Li}
*412f47f9SXin Li
*412f47f9SXin Listatic inline svuint32_t
*412f47f9SXin Lisv_u32 (uint32_t x)
*412f47f9SXin Li{
*412f47f9SXin Li  return svdup_u32 (x);
*412f47f9SXin Li}
*412f47f9SXin Li
*412f47f9SXin Listatic inline svfloat32_t
*412f47f9SXin Lisv_f32 (float x)
*412f47f9SXin Li{
*412f47f9SXin Li  return svdup_f32 (x);
*412f47f9SXin Li}
*412f47f9SXin Li
*412f47f9SXin Listatic inline svfloat32_t
*412f47f9SXin Lisv_call_f32 (float (*f) (float), svfloat32_t x, svfloat32_t y, svbool_t cmp)
*412f47f9SXin Li{
*412f47f9SXin Li  svbool_t p = svpfirst (cmp, svpfalse ());
*412f47f9SXin Li  while (svptest_any (cmp, p))
*412f47f9SXin Li    {
*412f47f9SXin Li      float elem = svclastb (p, 0, x);
*412f47f9SXin Li      elem = (*f) (elem);
*412f47f9SXin Li      svfloat32_t y2 = sv_f32 (elem);
*412f47f9SXin Li      y = svsel (p, y2, y);
*412f47f9SXin Li      p = svpnext_b32 (cmp, p);
*412f47f9SXin Li    }
*412f47f9SXin Li  return y;
*412f47f9SXin Li}
*412f47f9SXin Li
*412f47f9SXin Listatic inline svfloat32_t
*412f47f9SXin Lisv_call2_f32 (float (*f) (float, float), svfloat32_t x1, svfloat32_t x2,
*412f47f9SXin Li	      svfloat32_t y, svbool_t cmp)
*412f47f9SXin Li{
*412f47f9SXin Li  svbool_t p = svpfirst (cmp, svpfalse ());
*412f47f9SXin Li  while (svptest_any (cmp, p))
*412f47f9SXin Li    {
*412f47f9SXin Li      float elem1 = svclastb (p, 0, x1);
*412f47f9SXin Li      float elem2 = svclastb (p, 0, x2);
*412f47f9SXin Li      float ret = (*f) (elem1, elem2);
*412f47f9SXin Li      svfloat32_t y2 = sv_f32 (ret);
*412f47f9SXin Li      y = svsel (p, y2, y);
*412f47f9SXin Li      p = svpnext_b32 (cmp, p);
*412f47f9SXin Li    }
*412f47f9SXin Li  return y;
*412f47f9SXin Li}
*412f47f9SXin Li#endif
*412f47f9SXin Li
*412f47f9SXin Li#endif