308 lines · plain
1; NOTE: Assertions have been autogenerated by utils/update_llc_test_checks.py2; RUN: llc -mattr=+sve < %s | FileCheck %s3 4target triple = "aarch64-unknown-linux-gnu"5 6;7; ASR8;9 10define <vscale x 16 x i8> @asr_i8(<vscale x 16 x i1> %pg, <vscale x 16 x i8> %a, <vscale x 16 x i8> %b) {11; CHECK-LABEL: asr_i8:12; CHECK: // %bb.0:13; CHECK-NEXT: asr z0.b, p0/m, z0.b, z1.b14; CHECK-NEXT: ret15 %out = call <vscale x 16 x i8> @llvm.aarch64.sve.asr.u.nxv16i8(<vscale x 16 x i1> %pg,16 <vscale x 16 x i8> %a,17 <vscale x 16 x i8> %b)18 ret <vscale x 16 x i8> %out19}20 21define <vscale x 8 x i16> @asr_i16(<vscale x 8 x i1> %pg, <vscale x 8 x i16> %a, <vscale x 8 x i16> %b) {22; CHECK-LABEL: asr_i16:23; CHECK: // %bb.0:24; CHECK-NEXT: asr z0.h, p0/m, z0.h, z1.h25; CHECK-NEXT: ret26 %out = call <vscale x 8 x i16> @llvm.aarch64.sve.asr.u.nxv8i16(<vscale x 8 x i1> %pg,27 <vscale x 8 x i16> %a,28 <vscale x 8 x i16> %b)29 ret <vscale x 8 x i16> %out30}31 32define <vscale x 4 x i32> @asr_i32(<vscale x 4 x i1> %pg, <vscale x 4 x i32> %a, <vscale x 4 x i32> %b) {33; CHECK-LABEL: asr_i32:34; CHECK: // %bb.0:35; CHECK-NEXT: asr z0.s, p0/m, z0.s, z1.s36; CHECK-NEXT: ret37 %out = call <vscale x 4 x i32> @llvm.aarch64.sve.asr.u.nxv4i32(<vscale x 4 x i1> %pg,38 <vscale x 4 x i32> %a,39 <vscale x 4 x i32> %b)40 ret <vscale x 4 x i32> %out41}42 43define <vscale x 2 x i64> @asr_i64(<vscale x 2 x i1> %pg, <vscale x 2 x i64> %a, <vscale x 2 x i64> %b) {44; CHECK-LABEL: asr_i64:45; CHECK: // %bb.0:46; CHECK-NEXT: asr z0.d, p0/m, z0.d, z1.d47; CHECK-NEXT: ret48 %out = call <vscale x 2 x i64> @llvm.aarch64.sve.asr.u.nxv2i64(<vscale x 2 x i1> %pg,49 <vscale x 2 x i64> %a,50 <vscale x 2 x i64> %b)51 ret <vscale x 2 x i64> %out52}53 54;55; ASR (immediate)56;57 58define <vscale x 16 x i8> @asr_imm_i8(<vscale x 16 x i1> %pg, <vscale x 16 x i8> %a) {59; CHECK-LABEL: asr_imm_i8:60; CHECK: // %bb.0:61; CHECK-NEXT: asr z0.b, z0.b, #362; CHECK-NEXT: ret63 %out = call <vscale x 16 x i8> @llvm.aarch64.sve.asr.u.nxv16i8(<vscale x 16 x i1> %pg,64 <vscale x 16 x i8> %a,65 <vscale x 16 x i8> splat(i8 3))66 ret <vscale x 16 x i8> %out67}68 69define <vscale x 8 x i16> @asr_imm_i16(<vscale x 8 x i1> %pg, <vscale x 8 x i16> %a) {70; CHECK-LABEL: asr_imm_i16:71; CHECK: // %bb.0:72; CHECK-NEXT: asr z0.h, z0.h, #473; CHECK-NEXT: ret74 %out = call <vscale x 8 x i16> @llvm.aarch64.sve.asr.u.nxv8i16(<vscale x 8 x i1> %pg,75 <vscale x 8 x i16> %a,76 <vscale x 8 x i16> splat(i16 4))77 ret <vscale x 8 x i16> %out78}79 80define <vscale x 4 x i32> @asr_imm_i32(<vscale x 4 x i1> %pg, <vscale x 4 x i32> %a) {81; CHECK-LABEL: asr_imm_i32:82; CHECK: // %bb.0:83; CHECK-NEXT: asr z0.s, z0.s, #584; CHECK-NEXT: ret85 %out = call <vscale x 4 x i32> @llvm.aarch64.sve.asr.u.nxv4i32(<vscale x 4 x i1> %pg,86 <vscale x 4 x i32> %a,87 <vscale x 4 x i32> splat(i32 5))88 ret <vscale x 4 x i32> %out89}90 91define <vscale x 2 x i64> @asr_imm_i64(<vscale x 2 x i1> %pg, <vscale x 2 x i64> %a) {92; CHECK-LABEL: asr_imm_i64:93; CHECK: // %bb.0:94; CHECK-NEXT: asr z0.d, z0.d, #695; CHECK-NEXT: ret96 %out = call <vscale x 2 x i64> @llvm.aarch64.sve.asr.u.nxv2i64(<vscale x 2 x i1> %pg,97 <vscale x 2 x i64> %a,98 <vscale x 2 x i64> splat(i64 6))99 ret <vscale x 2 x i64> %out100}101 102;103; LSL104;105 106define <vscale x 16 x i8> @lsl_i8(<vscale x 16 x i1> %pg, <vscale x 16 x i8> %a, <vscale x 16 x i8> %b) {107; CHECK-LABEL: lsl_i8:108; CHECK: // %bb.0:109; CHECK-NEXT: lsl z0.b, p0/m, z0.b, z1.b110; CHECK-NEXT: ret111 %out = call <vscale x 16 x i8> @llvm.aarch64.sve.lsl.u.nxv16i8(<vscale x 16 x i1> %pg,112 <vscale x 16 x i8> %a,113 <vscale x 16 x i8> %b)114 ret <vscale x 16 x i8> %out115}116 117define <vscale x 8 x i16> @lsl_i16(<vscale x 8 x i1> %pg, <vscale x 8 x i16> %a, <vscale x 8 x i16> %b) {118; CHECK-LABEL: lsl_i16:119; CHECK: // %bb.0:120; CHECK-NEXT: lsl z0.h, p0/m, z0.h, z1.h121; CHECK-NEXT: ret122 %out = call <vscale x 8 x i16> @llvm.aarch64.sve.lsl.u.nxv8i16(<vscale x 8 x i1> %pg,123 <vscale x 8 x i16> %a,124 <vscale x 8 x i16> %b)125 ret <vscale x 8 x i16> %out126}127 128define <vscale x 4 x i32> @lsl_i32(<vscale x 4 x i1> %pg, <vscale x 4 x i32> %a, <vscale x 4 x i32> %b) {129; CHECK-LABEL: lsl_i32:130; CHECK: // %bb.0:131; CHECK-NEXT: lsl z0.s, p0/m, z0.s, z1.s132; CHECK-NEXT: ret133 %out = call <vscale x 4 x i32> @llvm.aarch64.sve.lsl.u.nxv4i32(<vscale x 4 x i1> %pg,134 <vscale x 4 x i32> %a,135 <vscale x 4 x i32> %b)136 ret <vscale x 4 x i32> %out137}138 139define <vscale x 2 x i64> @lsl_i64(<vscale x 2 x i1> %pg, <vscale x 2 x i64> %a, <vscale x 2 x i64> %b) {140; CHECK-LABEL: lsl_i64:141; CHECK: // %bb.0:142; CHECK-NEXT: lsl z0.d, p0/m, z0.d, z1.d143; CHECK-NEXT: ret144 %out = call <vscale x 2 x i64> @llvm.aarch64.sve.lsl.u.nxv2i64(<vscale x 2 x i1> %pg,145 <vscale x 2 x i64> %a,146 <vscale x 2 x i64> %b)147 ret <vscale x 2 x i64> %out148}149 150;151; LSL (immediate)152;153 154define <vscale x 16 x i8> @lsl_imm_i8(<vscale x 16 x i1> %pg, <vscale x 16 x i8> %a) {155; CHECK-LABEL: lsl_imm_i8:156; CHECK: // %bb.0:157; CHECK-NEXT: lsl z0.b, z0.b, #7158; CHECK-NEXT: ret159 %out = call <vscale x 16 x i8> @llvm.aarch64.sve.lsl.u.nxv16i8(<vscale x 16 x i1> %pg,160 <vscale x 16 x i8> %a,161 <vscale x 16 x i8> splat(i8 7))162 ret <vscale x 16 x i8> %out163}164 165define <vscale x 8 x i16> @lsl_imm_i16(<vscale x 8 x i1> %pg, <vscale x 8 x i16> %a) {166; CHECK-LABEL: lsl_imm_i16:167; CHECK: // %bb.0:168; CHECK-NEXT: lsl z0.h, z0.h, #8169; CHECK-NEXT: ret170 %out = call <vscale x 8 x i16> @llvm.aarch64.sve.lsl.u.nxv8i16(<vscale x 8 x i1> %pg,171 <vscale x 8 x i16> %a,172 <vscale x 8 x i16> splat(i16 8))173 ret <vscale x 8 x i16> %out174}175 176define <vscale x 4 x i32> @lsl_imm_i32(<vscale x 4 x i1> %pg, <vscale x 4 x i32> %a) {177; CHECK-LABEL: lsl_imm_i32:178; CHECK: // %bb.0:179; CHECK-NEXT: lsl z0.s, z0.s, #9180; CHECK-NEXT: ret181 %out = call <vscale x 4 x i32> @llvm.aarch64.sve.lsl.u.nxv4i32(<vscale x 4 x i1> %pg,182 <vscale x 4 x i32> %a,183 <vscale x 4 x i32> splat(i32 9))184 ret <vscale x 4 x i32> %out185}186 187define <vscale x 2 x i64> @lsl_imm_i64(<vscale x 2 x i1> %pg, <vscale x 2 x i64> %a) {188; CHECK-LABEL: lsl_imm_i64:189; CHECK: // %bb.0:190; CHECK-NEXT: lsl z0.d, z0.d, #10191; CHECK-NEXT: ret192 %out = call <vscale x 2 x i64> @llvm.aarch64.sve.lsl.u.nxv2i64(<vscale x 2 x i1> %pg,193 <vscale x 2 x i64> %a,194 <vscale x 2 x i64> splat(i64 10))195 ret <vscale x 2 x i64> %out196}197 198;199; LSR200;201 202define <vscale x 16 x i8> @lsr_i8(<vscale x 16 x i1> %pg, <vscale x 16 x i8> %a, <vscale x 16 x i8> %b) {203; CHECK-LABEL: lsr_i8:204; CHECK: // %bb.0:205; CHECK-NEXT: lsr z0.b, p0/m, z0.b, z1.b206; CHECK-NEXT: ret207 %out = call <vscale x 16 x i8> @llvm.aarch64.sve.lsr.u.nxv16i8(<vscale x 16 x i1> %pg,208 <vscale x 16 x i8> %a,209 <vscale x 16 x i8> %b)210 ret <vscale x 16 x i8> %out211}212 213define <vscale x 8 x i16> @lsr_i16(<vscale x 8 x i1> %pg, <vscale x 8 x i16> %a, <vscale x 8 x i16> %b) {214; CHECK-LABEL: lsr_i16:215; CHECK: // %bb.0:216; CHECK-NEXT: lsr z0.h, p0/m, z0.h, z1.h217; CHECK-NEXT: ret218 %out = call <vscale x 8 x i16> @llvm.aarch64.sve.lsr.u.nxv8i16(<vscale x 8 x i1> %pg,219 <vscale x 8 x i16> %a,220 <vscale x 8 x i16> %b)221 ret <vscale x 8 x i16> %out222}223 224define <vscale x 4 x i32> @lsr_i32(<vscale x 4 x i1> %pg, <vscale x 4 x i32> %a, <vscale x 4 x i32> %b) {225; CHECK-LABEL: lsr_i32:226; CHECK: // %bb.0:227; CHECK-NEXT: lsr z0.s, p0/m, z0.s, z1.s228; CHECK-NEXT: ret229 %out = call <vscale x 4 x i32> @llvm.aarch64.sve.lsr.u.nxv4i32(<vscale x 4 x i1> %pg,230 <vscale x 4 x i32> %a,231 <vscale x 4 x i32> %b)232 ret <vscale x 4 x i32> %out233}234 235define <vscale x 2 x i64> @lsr_i64(<vscale x 2 x i1> %pg, <vscale x 2 x i64> %a, <vscale x 2 x i64> %b) {236; CHECK-LABEL: lsr_i64:237; CHECK: // %bb.0:238; CHECK-NEXT: lsr z0.d, p0/m, z0.d, z1.d239; CHECK-NEXT: ret240 %out = call <vscale x 2 x i64> @llvm.aarch64.sve.lsr.u.nxv2i64(<vscale x 2 x i1> %pg,241 <vscale x 2 x i64> %a,242 <vscale x 2 x i64> %b)243 ret <vscale x 2 x i64> %out244}245 246;247; LSR (immediate)248;249 250define <vscale x 16 x i8> @lsr_imm_i8(<vscale x 16 x i1> %pg, <vscale x 16 x i8> %a) {251; CHECK-LABEL: lsr_imm_i8:252; CHECK: // %bb.0:253; CHECK-NEXT: lsr z0.b, z0.b, #8254; CHECK-NEXT: ret255 %out = call <vscale x 16 x i8> @llvm.aarch64.sve.lsr.u.nxv16i8(<vscale x 16 x i1> %pg,256 <vscale x 16 x i8> %a,257 <vscale x 16 x i8> splat(i8 8))258 ret <vscale x 16 x i8> %out259}260 261define <vscale x 8 x i16> @lsr_imm_i16(<vscale x 8 x i1> %pg, <vscale x 8 x i16> %a) {262; CHECK-LABEL: lsr_imm_i16:263; CHECK: // %bb.0:264; CHECK-NEXT: lsr z0.h, z0.h, #12265; CHECK-NEXT: ret266 %out = call <vscale x 8 x i16> @llvm.aarch64.sve.lsr.u.nxv8i16(<vscale x 8 x i1> %pg,267 <vscale x 8 x i16> %a,268 <vscale x 8 x i16> splat(i16 12))269 ret <vscale x 8 x i16> %out270}271 272define <vscale x 4 x i32> @lsr_imm_i32(<vscale x 4 x i1> %pg, <vscale x 4 x i32> %a) {273; CHECK-LABEL: lsr_imm_i32:274; CHECK: // %bb.0:275; CHECK-NEXT: lsr z0.s, z0.s, #13276; CHECK-NEXT: ret277 %out = call <vscale x 4 x i32> @llvm.aarch64.sve.lsr.u.nxv4i32(<vscale x 4 x i1> %pg,278 <vscale x 4 x i32> %a,279 <vscale x 4 x i32> splat(i32 13))280 ret <vscale x 4 x i32> %out281}282 283define <vscale x 2 x i64> @lsr_imm_i64(<vscale x 2 x i1> %pg, <vscale x 2 x i64> %a) {284; CHECK-LABEL: lsr_imm_i64:285; CHECK: // %bb.0:286; CHECK-NEXT: lsr z0.d, z0.d, #14287; CHECK-NEXT: ret288 %out = call <vscale x 2 x i64> @llvm.aarch64.sve.lsr.u.nxv2i64(<vscale x 2 x i1> %pg,289 <vscale x 2 x i64> %a,290 <vscale x 2 x i64> splat(i64 14))291 ret <vscale x 2 x i64> %out292}293 294declare <vscale x 16 x i8> @llvm.aarch64.sve.asr.u.nxv16i8(<vscale x 16 x i1>, <vscale x 16 x i8>, <vscale x 16 x i8>)295declare <vscale x 8 x i16> @llvm.aarch64.sve.asr.u.nxv8i16(<vscale x 8 x i1>, <vscale x 8 x i16>, <vscale x 8 x i16>)296declare <vscale x 4 x i32> @llvm.aarch64.sve.asr.u.nxv4i32(<vscale x 4 x i1>, <vscale x 4 x i32>, <vscale x 4 x i32>)297declare <vscale x 2 x i64> @llvm.aarch64.sve.asr.u.nxv2i64(<vscale x 2 x i1>, <vscale x 2 x i64>, <vscale x 2 x i64>)298 299declare <vscale x 16 x i8> @llvm.aarch64.sve.lsl.u.nxv16i8(<vscale x 16 x i1>, <vscale x 16 x i8>, <vscale x 16 x i8>)300declare <vscale x 8 x i16> @llvm.aarch64.sve.lsl.u.nxv8i16(<vscale x 8 x i1>, <vscale x 8 x i16>, <vscale x 8 x i16>)301declare <vscale x 4 x i32> @llvm.aarch64.sve.lsl.u.nxv4i32(<vscale x 4 x i1>, <vscale x 4 x i32>, <vscale x 4 x i32>)302declare <vscale x 2 x i64> @llvm.aarch64.sve.lsl.u.nxv2i64(<vscale x 2 x i1>, <vscale x 2 x i64>, <vscale x 2 x i64>)303 304declare <vscale x 16 x i8> @llvm.aarch64.sve.lsr.u.nxv16i8(<vscale x 16 x i1>, <vscale x 16 x i8>, <vscale x 16 x i8>)305declare <vscale x 8 x i16> @llvm.aarch64.sve.lsr.u.nxv8i16(<vscale x 8 x i1>, <vscale x 8 x i16>, <vscale x 8 x i16>)306declare <vscale x 4 x i32> @llvm.aarch64.sve.lsr.u.nxv4i32(<vscale x 4 x i1>, <vscale x 4 x i32>, <vscale x 4 x i32>)307declare <vscale x 2 x i64> @llvm.aarch64.sve.lsr.u.nxv2i64(<vscale x 2 x i1>, <vscale x 2 x i64>, <vscale x 2 x i64>)308