brintos

brintos / llvm-project-archived public Read only

0
0
Text · 7.0 KiB · 9d10f6c Raw
202 lines · plain
1; RUN: llc -verify-machineinstrs < %s -mtriple=aarch64-none-linux-gnu -disable-post-ra | FileCheck %s2; RUN: llc -verify-machineinstrs < %s -mtriple=aarch64-none-linux-gnu -mattr=-fp-armv8 -disable-post-ra | FileCheck --check-prefix=CHECK-NOFP %s3 4%myStruct = type { i64 , i8, i32 }5 6@var8 = dso_local global i8 07@var32 = dso_local global i32 08@var64 = dso_local global i64 09@var128 = dso_local global i128 010@varfloat = dso_local global float 0.011@vardouble = dso_local global double 0.012@varstruct = dso_local global %myStruct zeroinitializer13 14define dso_local void @take_i8s(i8 %val1, i8 %val2) {15; CHECK-LABEL: take_i8s:16    store i8 %val2, ptr @var817    ; Not using w1 may be technically allowed, but it would indicate a18    ; problem in itself.19;  CHECK: strb w1, [{{x[0-9]+}}, {{#?}}:lo12:var8]20    ret void21}22 23define dso_local void @add_floats(float %val1, float %val2) {24; CHECK-LABEL: add_floats:25    %newval = fadd float %val1, %val226; CHECK: fadd [[ADDRES:s[0-9]+]], s0, s127; CHECK-NOFP-NOT: fadd28    store float %newval, ptr @varfloat29; CHECK: str [[ADDRES]], [{{x[0-9]+}}, {{#?}}:lo12:varfloat]30    ret void31}32 33; byval pointers should be allocated to the stack and copied as if34; with memcpy.35define dso_local void @take_struct(ptr byval(%myStruct) %structval) {36; CHECK-LABEL: take_struct:37    %addr0 = getelementptr %myStruct, ptr %structval, i64 0, i32 238 39    %val0 = load volatile i32, ptr %addr040    ; Some weird move means x0 is used for one access41; CHECK: ldr [[REG32:w[0-9]+]], [{{x[0-9]+|sp}}, #12]42    store volatile i32 %val0, ptr @var3243; CHECK: str [[REG32]], [{{x[0-9]+}}, {{#?}}:lo12:var32]44 45    %val1 = load volatile i64, ptr %structval46; CHECK: ldr [[REG64:x[0-9]+]], [{{x[0-9]+|sp}}]47    store volatile i64 %val1, ptr @var6448; CHECK: str [[REG64]], [{{x[0-9]+}}, {{#?}}:lo12:var64]49 50    ret void51}52 53; %structval should be at sp + 1654define dso_local void @check_byval_align(ptr byval(i32) %ignore, ptr byval(%myStruct) align 16 %structval) {55; CHECK-LABEL: check_byval_align:56 57    %addr0 = getelementptr %myStruct, ptr %structval, i64 0, i32 258 59    %val0 = load volatile i32, ptr %addr060    ; Some weird move means x0 is used for one access61; CHECK: ldr [[REG32:w[0-9]+]], [sp, #28]62    store i32 %val0, ptr @var3263; CHECK: str [[REG32]], [{{x[0-9]+}}, {{#?}}:lo12:var32]64 65    %val1 = load volatile i64, ptr %structval66; CHECK: ldr [[REG64:x[0-9]+]], [sp, #16]67    store i64 %val1, ptr @var6468; CHECK: str [[REG64]], [{{x[0-9]+}}, {{#?}}:lo12:var64]69 70    ret void71}72 73define dso_local i32 @return_int() {74; CHECK-LABEL: return_int:75    %val = load i32, ptr @var3276    ret i32 %val77; CHECK: ldr w0, [{{x[0-9]+}}, {{#?}}:lo12:var32]78    ; Make sure epilogue follows79; CHECK-NEXT: ret80}81 82define dso_local double @return_double() {83; CHECK-LABEL: return_double:84    ret double 3.1485; CHECK: ldr d0, [{{x[0-9]+}}, {{#?}}:lo12:.LCPI86; CHECK-NOFP-NOT: ldr d0,87}88 89; This is the kind of IR clang will produce for returning a struct90; small enough to go into registers. Not all that pretty, but it91; works.92define [2 x i64] @return_struct() {93; CHECK-LABEL: return_struct:94    %val = load [2 x i64], ptr @varstruct95    ret [2 x i64] %val96; CHECK: add x[[VARSTRUCT:[0-9]+]], {{x[0-9]+}}, :lo12:varstruct97; CHECK: ldp x0, x1, [x[[VARSTRUCT]]]98    ; Make sure epilogue immediately follows99; CHECK-NEXT: ret100}101 102; Large structs are passed by reference (storage allocated by caller103; to preserve value semantics) in x8. Strictly this only applies to104; structs larger than 16 bytes, but C semantics can still be provided105; if LLVM does it to %myStruct too. So this is the simplest check106define dso_local void @return_large_struct(ptr sret(%myStruct) %retval) {107; CHECK-LABEL: return_large_struct:108    %addr1 = getelementptr %myStruct, ptr %retval, i64 0, i32 1109    %addr2 = getelementptr %myStruct, ptr %retval, i64 0, i32 2110 111    store i64 42, ptr %retval112    store i8 2, ptr %addr1113    store i32 9, ptr %addr2114; CHECK: str {{x[0-9]+}}, [x8]115; CHECK: strb {{w[0-9]+}}, [x8, #8]116; CHECK: str {{w[0-9]+}}, [x8, #12]117 118    ret void119}120 121; This struct is just too far along to go into registers: (only x7 is122; available, but it needs two). Also make sure that %stacked doesn't123; sneak into x7 behind.124define dso_local i32 @struct_on_stack(i8 %var0, i16 %var1, i32 %var2, i64 %var3, i128 %var45,125                          ptr %var6, ptr byval(%myStruct) %struct, ptr byval(i32) %stacked,126                          double %notstacked) {127; CHECK-LABEL: struct_on_stack:128    %val64 = load volatile i64, ptr %struct129    store volatile i64 %val64, ptr @var64130    ; Currently nothing on local stack, so struct should be at sp131; CHECK: ldr [[VAL64:x[0-9]+]], [sp]132; CHECK: str [[VAL64]], [{{x[0-9]+}}, {{#?}}:lo12:var64]133 134    store volatile double %notstacked, ptr @vardouble135; CHECK-NOT: ldr d0136; CHECK: str d0, [{{x[0-9]+}}, {{#?}}:lo12:vardouble137; CHECK-NOFP-NOT: str d0,138 139    %retval = load volatile i32, ptr %stacked140    ret i32 %retval141; CHECK-LE: ldr w0, [sp, #16]142}143 144define dso_local void @stacked_fpu(float %var0, double %var1, float %var2, float %var3,145                         float %var4, float %var5, float %var6, float %var7,146                         float %var8) {147; CHECK-LABEL: stacked_fpu:148    store float %var8, ptr @varfloat149    ; Beware as above: the offset would be different on big-endian150    ; machines if the first ldr were changed to use s-registers.151; CHECK: ldr {{[ds]}}[[VALFLOAT:[0-9]+]], [sp]152; CHECK: str s[[VALFLOAT]], [{{x[0-9]+}}, {{#?}}:lo12:varfloat]153 154    ret void155}156 157; 128-bit integer types should be passed in xEVEN, xODD rather than158; the reverse. In this case x2 and x3. Nothing should use x1.159define dso_local i64 @check_i128_regalign(i32 %val0, i128 %val1, i64 %val2) {160; CHECK-LABEL: check_i128_regalign161    store i128 %val1, ptr @var128162; CHECK-DAG: add x[[VAR128:[0-9]+]], {{x[0-9]+}}, :lo12:var128163; CHECK-DAG: stp x2, x3, [x[[VAR128]]]164 165    ret i64 %val2166; CHECK-DAG: mov x0, x4167}168 169define dso_local void @check_i128_stackalign(i32 %val0, i32 %val1, i32 %val2, i32 %val3,170                                   i32 %val4, i32 %val5, i32 %val6, i32 %val7,171                                   i32 %stack1, i128 %stack2) {172; CHECK-LABEL: check_i128_stackalign173    store i128 %stack2, ptr @var128174    ; Nothing local on stack in current codegen, so first stack is 16 away175; CHECK-LE: add     x[[REG:[0-9]+]], sp, #16176; CHECK-LE: ldr {{x[0-9]+}}, [x[[REG]], #8]177 178    ; Important point is that we address sp+24 for second dword179 180; CHECK: ldp {{x[0-9]+}}, {{x[0-9]+}}, [sp, #16]181    ret void182}183 184declare void @llvm.memcpy.p0.p0.i32(ptr, ptr, i32, i1)185 186define dso_local i32 @test_extern() {187; CHECK-LABEL: test_extern:188  call void @llvm.memcpy.p0.p0.i32(ptr align 4 undef, ptr align 4 undef, i32 undef, i1 0)189; CHECK: bl memcpy190  ret i32 0191}192 193 194; A sub-i32 stack argument must be loaded on big endian with ldr{h,b}, not just195; implicitly extended to a 32-bit load.196define dso_local i16 @stacked_i16(i32 %val0, i32 %val1, i32 %val2, i32 %val3,197                        i32 %val4, i32 %val5, i32 %val6, i32 %val7,198                        i16 %stack1) {199; CHECK-LABEL: stacked_i16200  ret i16 %stack1201}202