brintos

brintos / llvm-project-archived public Read only

0
0
Text · 3.3 KiB · c4e5a22 Raw
69 lines · cpp
1//===-- GPU benchmark for logf --------------------------------------------===//2//3// Part of the LLVM Project, under the Apache License v2.0 with LLVM Exceptions.4// See https://llvm.org/LICENSE.txt for license information.5// SPDX-License-Identifier: Apache-2.0 WITH LLVM-exception6//7//===----------------------------------------------------------------------===//8 9#include "benchmarks/gpu/LibcGpuBenchmark.h"10#include "benchmarks/gpu/Random.h"11 12#include "hdr/stdint_proxy.h"13#include "src/__support/sign.h"14#include "src/math/logf.h"15 16#if defined(NVPTX_MATH_FOUND) || defined(AMDGPU_MATH_FOUND)17#include "platform.h"18#endif19 20#define RANDOM_INPUT_UniformExponent(T, Func, Min, Max, N)                     \21  [](uint32_t call_index) {                                                    \22    using namespace LIBC_NAMESPACE::benchmarks;                                \23                                                                               \24    const UniformExponent<T> dist(Min, Max, LIBC_NAMESPACE::Sign::POS);        \25    return MathPerf<T>::template run_throughput<N>(Func, dist, call_index);    \26  }27 28#define RANDOM_INPUT_UniformLinear(T, Func, Min, Max, N)                       \29  [](uint32_t call_index) {                                                    \30    using namespace LIBC_NAMESPACE::benchmarks;                                \31                                                                               \32    const UniformLinear<T> dist(Min, Max);                                     \33    return MathPerf<T>::template run_throughput<N>(Func, dist, call_index);    \34  }35 36#define BENCH(T, Name, Func, Dist, Min, Max)                                   \37  SINGLE_WAVE_BENCHMARK(LlvmLibcLogfGpuBenchmark, Name##_1,                    \38                        RANDOM_INPUT_##Dist(T, Func, Min, Max, 1));            \39  SINGLE_WAVE_BENCHMARK(LlvmLibcLogfGpuBenchmark, Name##_128,                  \40                        RANDOM_INPUT_##Dist(T, Func, Min, Max, 128));          \41  SINGLE_WAVE_BENCHMARK(LlvmLibcLogfGpuBenchmark, Name##_1024,                 \42                        RANDOM_INPUT_##Dist(T, Func, Min, Max, 1024));         \43  SINGLE_WAVE_BENCHMARK(LlvmLibcLogfGpuBenchmark, Name##_4096,                 \44                        RANDOM_INPUT_##Dist(T, Func, Min, Max, 4096))45 46using LIBC_NAMESPACE::logf;47 48static constexpr float INV_E = 0x1.78b56362cef38p-2f; // exp(-1.0)49static constexpr float E = 0x1.5bf0a8b145769p+1f;     // exp(+1.0)50 51BENCH(float, LogfSubnormal, logf, UniformExponent, -126, -126);52BENCH(float, LogfAroundOne, logf, UniformLinear, INV_E, E);53BENCH(float, LogfMedMag, logf, UniformExponent, -10, 10);54BENCH(float, LogfNormal, logf, UniformExponent, -125, 127);55 56#ifdef NVPTX_MATH_FOUND57BENCH(float, NvLogfSubnormal, __nv_logf, UniformExponent, -126, -126);58BENCH(float, NvLogfAroundOne, __nv_logf, UniformLinear, INV_E, E);59BENCH(float, NvLogfMedMag, __nv_logf, UniformExponent, -10, 10);60BENCH(float, NvLogfNormal, __nv_logf, UniformExponent, -125, 127);61#endif62 63#ifdef AMDGPU_MATH_FOUND64BENCH(float, AmdLogfSubnormal, __ocml_log_f32, UniformExponent, -126, -126);65BENCH(float, AmdLogfAroundOne, __ocml_log_f32, UniformLinear, INV_E, E);66BENCH(float, AmdLogfMedMag, __ocml_log_f32, UniformExponent, -10, 10);67BENCH(float, AmdLogfNormal, __ocml_log_f32, UniformExponent, -125, 127);68#endif69