93 lines · plain
1; NOTE: There must be no spill reload inside the loop starting with LBB0_1:2; RUN: llc -mtriple=amdgcn-amd-amdhsa -mcpu=gfx908 < %s | FileCheck %s3 4define amdgpu_kernel void @foo(ptr %.sroa.1.0.copyload, ptr %0, ptr %1, ptr %2, ptr %3, ptr %4, ptr %5, ptr %6, ptr %7, ptr %8, ptr %9, ptr %10, ptr %11, ptr %12, ptr %13, ptr %14, ptr %15, ptr %16, ptr %17, ptr %18, ptr %19, ptr %20, ptr %21, ptr %22, ptr %23, ptr %24, ptr %25, ptr %26, ptr %27, ptr %28, ptr %29, ptr %30, ptr %31, ptr %32, ptr %33, double %34, double %35, double %36, float %37, float %38, float %39, float %40, ptr %41) {5; CHECK-LABEL: foo:6; CHECK-LABEL: .LBB0_17; CHECK-NOT: buffer_load_dword {{v[0-9]+}}8 9.lr.ph:10 %.pre = load double, ptr null, align 811 br label %4212 1342: ; preds = %42, %.lr.ph14 %.0.i4402 = phi i32 [ 1, %.lr.ph ], [ 0, %42 ]15 %43 = zext i32 %.0.i4402 to i6416 %44 = load double, ptr %2, align 817 %45 = load double, ptr %4, align 818 %46 = load double, ptr %7, align 819 %47 = load double, ptr %13, align 820 %48 = load double, ptr %15, align 821 %49 = load double, ptr %17, align 822 %50 = load double, ptr %19, align 823 %51 = load double, ptr %18, align 824 %52 = load double, ptr %27, align 825 %53 = load double, ptr %23, align 826 %54 = load double, ptr %31, align 827 %55 = load double, ptr %33, align 828 %56 = load double, ptr %25, align 829 %57 = load double, ptr %16, align 830 %58 = fpext float %40 to double31 %59 = fmul double %52, %5832 %60 = fadd double %59, %5133 %61 = fsub double %60, %4834 %62 = fmul double 0.000000e+00, %3635 %63 = fsub double %61, %6236 %64 = fadd double %49, %6337 %65 = fptrunc double %64 to float38 %66 = fsub double 0.000000e+00, %3439 %67 = fpext float %39 to double40 %68 = fmul double %53, %6741 %69 = fsub double %66, %6842 %70 = fadd double %50, %6943 %71 = fptrunc double %70 to float44 store float 0.000000e+00, ptr %30, align 445 store float 0.000000e+00, ptr %26, align 446 %72 = getelementptr float, ptr %41, i64 %4347 store float %38, ptr %72, align 448 store float %65, ptr %29, align 449 store float %71, ptr %14, align 450 store float %39, ptr %3, align 451 store float %39, ptr %11, align 452 %73 = fsub double %46, %4453 %74 = fptrunc double %73 to float54 %75 = fsub double %47, %4555 %76 = fptrunc double %75 to float56 %77 = fadd float %74, %7657 %78 = fpext float %37 to double58 %79 = fmul contract double %56, 0.000000e+0059 %80 = fsub contract double %34, %7960 %81 = fpext float %77 to double61 %82 = fmul double %.pre, %8162 %83 = fsub double %80, %8263 %84 = fpext float %38 to double64 %85 = fmul double %57, %8465 %86 = fsub double %83, %8566 %87 = fptrunc double %86 to float67 %88 = fmul double %34, 0.000000e+0068 %89 = fmul double %54, %7869 %90 = fadd double %89, %8870 %91 = fsub double %90, %5571 %92 = fmul double 0.000000e+00, %3572 %93 = fsub double %91, %9273 %94 = fmul double %34, %3474 %95 = fadd double %93, %9475 %96 = fptrunc double %95 to float76 store float %87, ptr %1, align 477 store float %37, ptr %21, align 478 store float %96, ptr %0, align 479 store float 0.000000e+00, ptr %9, align 480 store float 0.000000e+00, ptr %32, align 481 store float 0.000000e+00, ptr %20, align 482 store float 0.000000e+00, ptr %22, align 483 store float 0.000000e+00, ptr %5, align 484 store float 0.000000e+00, ptr %28, align 485 store float 0.000000e+00, ptr %12, align 486 store float 0.000000e+00, ptr %6, align 487 store float 0.000000e+00, ptr %8, align 488 store float 0.000000e+00, ptr %.sroa.1.0.copyload, align 489 store float %37, ptr %10, align 490 store float 0.000000e+00, ptr %24, align 491 br label %4292}93