54 lines · plain
1; NOTE: Assertions have been autogenerated by utils/update_llc_test_checks.py UTC_ARGS: --version 32; RUN: llc -mtriple=riscv64 -mattr=+v,+f,+m,+zvfh \3; RUN: < %s | FileCheck %s4 5define void @foo(<vscale x 8 x i8> %0) {6; CHECK-LABEL: foo:7; CHECK: # %bb.0:8; CHECK-NEXT: addi sp, sp, -329; CHECK-NEXT: .cfi_def_cfa_offset 3210; CHECK-NEXT: sd ra, 24(sp) # 8-byte Folded Spill11; CHECK-NEXT: sd s0, 16(sp) # 8-byte Folded Spill12; CHECK-NEXT: sd s1, 8(sp) # 8-byte Folded Spill13; CHECK-NEXT: sd s2, 0(sp) # 8-byte Folded Spill14; CHECK-NEXT: .cfi_offset ra, -815; CHECK-NEXT: .cfi_offset s0, -1616; CHECK-NEXT: .cfi_offset s1, -2417; CHECK-NEXT: .cfi_offset s2, -3218; CHECK-NEXT: li s0, 019; CHECK-NEXT: vsetvli a0, zero, e8, m1, ta, ma20; CHECK-NEXT: vmv.v.i v9, 021; CHECK-NEXT: vsetivli zero, 0, e8, m1, tu, ma22; CHECK-NEXT: vslideup.vi v9, v10, 023; CHECK-NEXT: vslideup.vi v8, v10, 024; CHECK-NEXT: vsetvli zero, zero, e64, m8, ta, ma25; CHECK-NEXT: vmv.x.s s1, v926; CHECK-NEXT: vmv.x.s s2, v827; CHECK-NEXT: .LBB0_1: # =>This Inner Loop Header: Depth=128; CHECK-NEXT: mv a0, s129; CHECK-NEXT: mv a1, s030; CHECK-NEXT: mv a2, s231; CHECK-NEXT: mv a3, s032; CHECK-NEXT: mv a4, s033; CHECK-NEXT: mv a5, s034; CHECK-NEXT: jalr s035; CHECK-NEXT: j .LBB0_136 %2 = tail call <vscale x 8 x i8> @llvm.vector.insert.nxv8i8.v16i8(<vscale x 8 x i8> poison, <16 x i8> poison, i64 0)37 %3 = tail call <vscale x 8 x i8> @llvm.vector.insert.nxv8i8.v16i8(<vscale x 8 x i8> poison, <16 x i8> poison, i64 0)38 br label %439 404: ; preds = %4, %141 %5 = tail call <vscale x 8 x i8> @llvm.riscv.vslideup.nxv8i8.i64(<vscale x 8 x i8> zeroinitializer, <vscale x 8 x i8> %2, i64 0, i64 0, i64 0)42 %6 = tail call <16 x i8> @llvm.vector.extract.v16i8.nxv8i8(<vscale x 8 x i8> %5, i64 0)43 %7 = bitcast <16 x i8> %6 to <2 x i64>44 %8 = extractelement <2 x i64> %7, i64 045 %9 = insertvalue [2 x i64] zeroinitializer, i64 %8, 046 %10 = tail call <vscale x 8 x i8> @llvm.riscv.vslideup.nxv8i8.i64(<vscale x 8 x i8> %0, <vscale x 8 x i8> %3, i64 0, i64 0, i64 0)47 %11 = tail call <16 x i8> @llvm.vector.extract.v16i8.nxv8i8(<vscale x 8 x i8> %10, i64 0)48 %12 = bitcast <16 x i8> %11 to <2 x i64>49 %13 = extractelement <2 x i64> %12, i64 050 %14 = insertvalue [2 x i64] zeroinitializer, i64 %13, 051 %15 = tail call fastcc [2 x i64] null([2 x i64] %9, [2 x i64] %14, [2 x i64] zeroinitializer)52 br label %453}54