; NOTE: Assertions have been autogenerated by utils/update_llc_test_checks.py UTC_ARGS: --version 6 ; RUN: llc < %s | FileCheck %s target datalayout = "e-m:o-i64:64-i128:128-n32:64-S128-Fn32" target triple = "arm64-apple-macosx15.0.0" ; From: https://github.com/llvm/llvm-project/issues/161420. This test checks that ; two `luti4` instructions are emitted. define void @pluto(ptr %arg, ptr %arg1, ptr %arg2, ptr %arg3) #0 { ; CHECK-LABEL: pluto: ; CHECK: ; %bb.0: ; %bb ; CHECK-NEXT: mov w8, #0 ; =0x0 ; CHECK-NEXT: ldr zt0, [x1] ; CHECK-NEXT: ldr z4, [x3] ; CHECK-NEXT: ptrue pn8.h ; CHECK-NEXT: ld1h { z0.h - z3.h }, pn8/z, [x0] ; CHECK-NEXT: luti4 { z16.h - z19.h }, zt0, z4[0] ; CHECK-NEXT: fmla za.h[w8, 0, vgx4], { z0.h - z3.h }, { z16.h - z19.h } ; CHECK-NEXT: ldr zt0, [x2] ; CHECK-NEXT: luti4 { z4.h - z7.h }, zt0, z4[0] ; CHECK-NEXT: fmla za.h[w8, 2, vgx4], { z0.h - z3.h }, { z4.h - z7.h } ; CHECK-NEXT: ret bb: tail call void @llvm.aarch64.sme.ldr.zt(i32 0, ptr %arg1) %load = load , ptr %arg3, align 16 %call = tail call target("aarch64.svcount") @llvm.aarch64.sve.ptrue.c16() %call4 = tail call { , , , } @llvm.aarch64.sve.ld1.pn.x4.nxv8f16(target("aarch64.svcount") %call, ptr %arg) %extractvalue = extractvalue { , , , } %call4, 0 %extractvalue5 = extractvalue { , , , } %call4, 1 %extractvalue6 = extractvalue { , , , } %call4, 2 %extractvalue7 = extractvalue { , , , } %call4, 3 %call8 = tail call { , , , } @llvm.aarch64.sme.luti4.lane.zt.x4.nxv8f16(i32 0, %load, i32 0) %extractvalue9 = extractvalue { , , , } %call8, 0 %extractvalue10 = extractvalue { , , , } %call8, 1 %extractvalue11 = extractvalue { , , , } %call8, 2 %extractvalue12 = extractvalue { , , , } %call8, 3 tail call void @llvm.aarch64.sme.fmla.vg1x4.nxv8f16(i32 0, %extractvalue, %extractvalue5, %extractvalue6, %extractvalue7, %extractvalue9, %extractvalue10, %extractvalue11, %extractvalue12) tail call void @llvm.aarch64.sme.ldr.zt(i32 0, ptr %arg2) %call13 = tail call { , , , } @llvm.aarch64.sme.luti4.lane.zt.x4.nxv8f16(i32 0, %load, i32 0) %extractvalue14 = extractvalue { , , , } %call13, 0 %extractvalue15 = extractvalue { , , , } %call13, 1 %extractvalue16 = extractvalue { , , , } %call13, 2 %extractvalue17 = extractvalue { , , , } %call13, 3 tail call void @llvm.aarch64.sme.fmla.vg1x4.nxv8f16(i32 2, %extractvalue, %extractvalue5, %extractvalue6, %extractvalue7, %extractvalue14, %extractvalue15, %extractvalue16, %extractvalue17) ret void } declare void @llvm.aarch64.sme.ldr.zt(i32, ptr) declare target("aarch64.svcount") @llvm.aarch64.sve.ptrue.c16() declare { , , , } @llvm.aarch64.sve.ld1.pn.x4.nxv8f16(target("aarch64.svcount"), ptr) declare { , , , } @llvm.aarch64.sme.luti4.lane.zt.x4.nxv8f16(i32 immarg, , i32 immarg) declare void @llvm.aarch64.sme.fmla.vg1x4.nxv8f16(i32, , , , , , , , ) attributes #0 = { mustprogress nofree noinline norecurse nosync nounwind ssp willreturn uwtable(sync) "aarch64_inout_za" "aarch64_inout_zt0" "aarch64_pstate_sm_enabled" "target-cpu"="apple-m1" "target-features"="+fp-armv8,+lse,+neon,+sme,+sme-f16f16,+sme2,+v8.1a,+v8.2a,+v8.3a,+v8.4a,+v8.5a,+v8a" }