brintos

brintos / llvm-project-archived public Read only

0
0
Text · 2.6 KiB · ff9dcbe Raw
66 lines · plain
1; NOTE: Assertions have been autogenerated by utils/update_llc_test_checks.py2; RUN: llc -verify-machineinstrs  -mtriple=aarch64-linux-gnu -mattr=+aes -o - %s| FileCheck %s --check-prefixes=CHECK3 4; Two operands are in scalar form.5; Tests that both operands are loaded into SIMD registers directly as opposed to being loaded into GPR followed by a fmov.6define void @test1(ptr %0, i64 %1, i64 %2) {7; CHECK-LABEL: test1:8; CHECK:       // %bb.0:9; CHECK-NEXT:    add x8, x0, x1, lsl #410; CHECK-NEXT:    add x9, x0, x2, lsl #411; CHECK-NEXT:    ldr d0, [x9, #8]12; CHECK-NEXT:    ldr d1, [x8, #8]13; CHECK-NEXT:    pmull v0.1q, v1.1d, v0.1d14; CHECK-NEXT:    str q0, [x0]15; CHECK-NEXT:    ret16  %4 = getelementptr inbounds <2 x i64>, ptr %0, i64 %117  %5 = getelementptr inbounds <2 x i64>, ptr %0, i64 %1, i64 118  %6 = load i64, ptr %5, align 819  %7 = getelementptr inbounds <2 x i64>, ptr %0, i64 %2, i64 120  %8 = load i64, ptr %7, align 821  %9 = tail call <16 x i8> @llvm.aarch64.neon.pmull64(i64 %6, i64 %8)22  store <16 x i8> %9, ptr %0, align 1623  ret void24}25 26; Operand %8 is higher-half of v2i64, and operand %7 is a scalar load.27; Tests that operand is loaded into SIMD registers directly as opposed to being loaded into GPR followed by a fmov.28define void @test2(ptr %0, i64 %1, i64 %2, <2 x i64> %3) {29; CHECK-LABEL: test2:30; CHECK:       // %bb.0:31; CHECK-NEXT:    add x8, x0, x1, lsl #432; CHECK-NEXT:    add x9, x8, #833; CHECK-NEXT:    ld1r { v1.2d }, [x9]34; CHECK-NEXT:    pmull2 v0.1q, v0.2d, v1.2d35; CHECK-NEXT:    str q0, [x8]36; CHECK-NEXT:    ret37  %5 = getelementptr inbounds <2 x i64>, ptr %0, i64 %138  %6 = getelementptr inbounds <2 x i64>, ptr %0, i64 %1, i64 139  %7 = load i64, ptr %6, align 840  %8 = extractelement <2 x i64> %3, i64 141  %9 = tail call <16 x i8> @llvm.aarch64.neon.pmull64(i64 %8, i64 %7)42  store <16 x i8> %9, ptr %5, align 1643  ret void44}45 46; Operand %7 is a scalar load, and operand %3 is an input parameter of function `test4`.47; Test that %7 is loaded into SIMD registers.48define void @test3(ptr %0, i64 %1, i64 %2, i64 %3) {49; CHECK-LABEL: test3:50; CHECK:       // %bb.0:51; CHECK-NEXT:    add x8, x0, x1, lsl #452; CHECK-NEXT:    fmov d1, x353; CHECK-NEXT:    ldr d0, [x8, #8]54; CHECK-NEXT:    pmull v0.1q, v0.1d, v1.1d55; CHECK-NEXT:    str q0, [x8]56; CHECK-NEXT:    ret57  %5 = getelementptr inbounds <2 x i64>, ptr %0, i64 %158  %6 = getelementptr inbounds <2 x i64>, ptr %0, i64 %1, i64 159  %7 = load i64, ptr %6, align 860  %8 = tail call <16 x i8> @llvm.aarch64.neon.pmull64(i64 %7, i64 %3)61  store <16 x i8> %8, ptr %5, align 1662  ret void63}64 65declare <16 x i8> @llvm.aarch64.neon.pmull64(i64, i64)66