93 lines · plain
1; NOTE: Assertions have been autogenerated by utils/update_llc_test_checks.py2; RUN: llc < %s --mattr=+complxnum,+neon,+fullfp16 -o - | FileCheck %s3 4target triple = "aarch64"5 6; Expected to transform7define <2 x double> @complex_mul_v2f64(<2 x double> %a, <2 x double> %b) {8; CHECK-LABEL: complex_mul_v2f64:9; CHECK: // %bb.0: // %entry10; CHECK-NEXT: movi v2.2d, #000000000000000011; CHECK-NEXT: fcmla v2.2d, v1.2d, v0.2d, #012; CHECK-NEXT: fcmla v2.2d, v1.2d, v0.2d, #9013; CHECK-NEXT: mov v0.16b, v2.16b14; CHECK-NEXT: ret15entry:16 %a.real = shufflevector <2 x double> %a, <2 x double> poison, <1 x i32> <i32 0>17 %a.imag = shufflevector <2 x double> %a, <2 x double> poison, <1 x i32> <i32 1>18 %b.real = shufflevector <2 x double> %b, <2 x double> poison, <1 x i32> <i32 0>19 %b.imag = shufflevector <2 x double> %b, <2 x double> poison, <1 x i32> <i32 1>20 %0 = fmul fast <1 x double> %b.imag, %a.real21 %1 = fmul fast <1 x double> %b.real, %a.imag22 %2 = fadd fast <1 x double> %1, %023 %3 = fmul fast <1 x double> %b.real, %a.real24 %4 = fmul fast <1 x double> %a.imag, %b.imag25 %5 = fsub fast <1 x double> %3, %426 %interleaved.vec = shufflevector <1 x double> %5, <1 x double> %2, <2 x i32> <i32 0, i32 1>27 ret <2 x double> %interleaved.vec28}29 30; Expected to transform31define <4 x double> @complex_mul_v4f64(<4 x double> %a, <4 x double> %b) {32; CHECK-LABEL: complex_mul_v4f64:33; CHECK: // %bb.0: // %entry34; CHECK-NEXT: movi v4.2d, #000000000000000035; CHECK-NEXT: movi v5.2d, #000000000000000036; CHECK-NEXT: fcmla v5.2d, v2.2d, v0.2d, #037; CHECK-NEXT: fcmla v4.2d, v3.2d, v1.2d, #038; CHECK-NEXT: fcmla v5.2d, v2.2d, v0.2d, #9039; CHECK-NEXT: fcmla v4.2d, v3.2d, v1.2d, #9040; CHECK-NEXT: mov v0.16b, v5.16b41; CHECK-NEXT: mov v1.16b, v4.16b42; CHECK-NEXT: ret43entry:44 %a.real = shufflevector <4 x double> %a, <4 x double> poison, <2 x i32> <i32 0, i32 2>45 %a.imag = shufflevector <4 x double> %a, <4 x double> poison, <2 x i32> <i32 1, i32 3>46 %b.real = shufflevector <4 x double> %b, <4 x double> poison, <2 x i32> <i32 0, i32 2>47 %b.imag = shufflevector <4 x double> %b, <4 x double> poison, <2 x i32> <i32 1, i32 3>48 %0 = fmul fast <2 x double> %b.imag, %a.real49 %1 = fmul fast <2 x double> %b.real, %a.imag50 %2 = fadd fast <2 x double> %1, %051 %3 = fmul fast <2 x double> %b.real, %a.real52 %4 = fmul fast <2 x double> %a.imag, %b.imag53 %5 = fsub fast <2 x double> %3, %454 %interleaved.vec = shufflevector <2 x double> %5, <2 x double> %2, <4 x i32> <i32 0, i32 2, i32 1, i32 3>55 ret <4 x double> %interleaved.vec56}57 58; Expected to transform59define <8 x double> @complex_mul_v8f64(<8 x double> %a, <8 x double> %b) {60; CHECK-LABEL: complex_mul_v8f64:61; CHECK: // %bb.0: // %entry62; CHECK-NEXT: movi v16.2d, #000000000000000063; CHECK-NEXT: movi v17.2d, #000000000000000064; CHECK-NEXT: movi v18.2d, #000000000000000065; CHECK-NEXT: movi v19.2d, #000000000000000066; CHECK-NEXT: fcmla v16.2d, v4.2d, v0.2d, #067; CHECK-NEXT: fcmla v18.2d, v5.2d, v1.2d, #068; CHECK-NEXT: fcmla v17.2d, v7.2d, v3.2d, #069; CHECK-NEXT: fcmla v19.2d, v6.2d, v2.2d, #070; CHECK-NEXT: fcmla v16.2d, v4.2d, v0.2d, #9071; CHECK-NEXT: fcmla v18.2d, v5.2d, v1.2d, #9072; CHECK-NEXT: fcmla v17.2d, v7.2d, v3.2d, #9073; CHECK-NEXT: fcmla v19.2d, v6.2d, v2.2d, #9074; CHECK-NEXT: mov v0.16b, v16.16b75; CHECK-NEXT: mov v1.16b, v18.16b76; CHECK-NEXT: mov v3.16b, v17.16b77; CHECK-NEXT: mov v2.16b, v19.16b78; CHECK-NEXT: ret79entry:80 %a.real = shufflevector <8 x double> %a, <8 x double> poison, <4 x i32> <i32 0, i32 2, i32 4, i32 6>81 %a.imag = shufflevector <8 x double> %a, <8 x double> poison, <4 x i32> <i32 1, i32 3, i32 5, i32 7>82 %b.real = shufflevector <8 x double> %b, <8 x double> poison, <4 x i32> <i32 0, i32 2, i32 4, i32 6>83 %b.imag = shufflevector <8 x double> %b, <8 x double> poison, <4 x i32> <i32 1, i32 3, i32 5, i32 7>84 %0 = fmul fast <4 x double> %b.imag, %a.real85 %1 = fmul fast <4 x double> %b.real, %a.imag86 %2 = fadd fast <4 x double> %1, %087 %3 = fmul fast <4 x double> %b.real, %a.real88 %4 = fmul fast <4 x double> %a.imag, %b.imag89 %5 = fsub fast <4 x double> %3, %490 %interleaved.vec = shufflevector <4 x double> %5, <4 x double> %2, <8 x i32> <i32 0, i32 4, i32 1, i32 5, i32 2, i32 6, i32 3, i32 7>91 ret <8 x double> %interleaved.vec92}93