90 lines · plain
1; NOTE: Assertions have been autogenerated by utils/update_llc_test_checks.py2; REQUIRES: asserts3; RUN: llc < %s -mattr=+sse3,+sse4.1 -mcpu=penryn -stats 2>&1 | grep "6 machinelicm"4; RUN: llc < %s -mattr=+sse3,+sse4.1 -mcpu=penryn | FileCheck %s5; rdar://66277866; rdar://77920377 8target triple = "x86_64-apple-darwin10.0"9 %struct.Key = type { i64 }10 %struct.__Rec = type opaque11 %struct.__vv = type { }12 13define ptr @t(ptr %desc, i64 %p) nounwind ssp {14; CHECK-LABEL: t:15; CHECK: ## %bb.0: ## %entry16; CHECK-NEXT: pushq %r1417; CHECK-NEXT: pushq %rbx18; CHECK-NEXT: pushq %rax19; CHECK-NEXT: movq %rsi, %rbx20; CHECK-NEXT: movq %rdi, %r1421; CHECK-NEXT: orq $2097152, %rbx ## imm = 0x20000022; CHECK-NEXT: andl $15728640, %ebx ## imm = 0xF0000023; CHECK-NEXT: .p2align 424; CHECK-NEXT: LBB0_1: ## %bb425; CHECK-NEXT: ## =>This Inner Loop Header: Depth=126; CHECK-NEXT: xorl %eax, %eax27; CHECK-NEXT: callq _xxGetOffsetForCode28; CHECK-NEXT: movq %r14, %rdi29; CHECK-NEXT: xorl %esi, %esi30; CHECK-NEXT: xorl %eax, %eax31; CHECK-NEXT: callq _xxCalculateMidType32; CHECK-NEXT: cmpl $1, %eax33; CHECK-NEXT: jne LBB0_134; CHECK-NEXT: ## %bb.2: ## %bb2635; CHECK-NEXT: ## in Loop: Header=BB0_1 Depth=136; CHECK-NEXT: cmpl $1048576, %ebx ## imm = 0x10000037; CHECK-NEXT: jne LBB0_138; CHECK-NEXT: ## %bb.3: ## %bb.i39; CHECK-NEXT: ## in Loop: Header=BB0_1 Depth=140; CHECK-NEXT: movl 0, %eax41; CHECK-NEXT: xorps %xmm0, %xmm042; CHECK-NEXT: cvtsi2ss %rax, %xmm043; CHECK-NEXT: movl 4, %eax44; CHECK-NEXT: xorps %xmm1, %xmm145; CHECK-NEXT: cvtsi2ss %rax, %xmm146; CHECK-NEXT: movl 8, %eax47; CHECK-NEXT: xorps %xmm2, %xmm248; CHECK-NEXT: cvtsi2ss %rax, %xmm249; CHECK-NEXT: insertps {{.*#+}} xmm0 = xmm0[0],xmm1[0],xmm0[2,3]50; CHECK-NEXT: insertps {{.*#+}} xmm0 = xmm0[0,1],xmm2[0],xmm0[3]51; CHECK-NEXT: movaps %xmm0, 052; CHECK-NEXT: jmp LBB0_153entry:54 br label %bb455 56bb4: ; preds = %bb.i, %bb26, %bb4, %entry57 58 %0 = call i32 (...) @xxGetOffsetForCode(i32 undef) nounwind ; <i32> [#uses=0]59 %ins = or i64 %p, 2097152 ; <i64> [#uses=1]60 %1 = call i32 (...) @xxCalculateMidType(ptr %desc, i32 0) nounwind ; <i32> [#uses=1]61 %cond = icmp eq i32 %1, 1 ; <i1> [#uses=1]62 br i1 %cond, label %bb26, label %bb463 64bb26: ; preds = %bb465 %2 = and i64 %ins, 15728640 ; <i64> [#uses=1]66 %cond.i = icmp eq i64 %2, 1048576 ; <i1> [#uses=1]67 br i1 %cond.i, label %bb.i, label %bb468 69bb.i: ; preds = %bb2670 %3 = load i32, ptr null, align 4 ; <i32> [#uses=1]71 %4 = uitofp i32 %3 to float ; <float> [#uses=1]72 %.sum13.i = add i64 0, 4 ; <i64> [#uses=1]73 %5 = getelementptr i8, ptr null, i64 %.sum13.i ; <ptr> [#uses=1]74 %6 = load i32, ptr %5, align 4 ; <i32> [#uses=1]75 %7 = uitofp i32 %6 to float ; <float> [#uses=1]76 %.sum.i = add i64 0, 8 ; <i64> [#uses=1]77 %8 = getelementptr i8, ptr null, i64 %.sum.i ; <ptr> [#uses=1]78 %9 = load i32, ptr %8, align 4 ; <i32> [#uses=1]79 %10 = uitofp i32 %9 to float ; <float> [#uses=1]80 %11 = insertelement <4 x float> undef, float %4, i32 0 ; <<4 x float>> [#uses=1]81 %12 = insertelement <4 x float> %11, float %7, i32 1 ; <<4 x float>> [#uses=1]82 %13 = insertelement <4 x float> %12, float %10, i32 2 ; <<4 x float>> [#uses=1]83 store <4 x float> %13, ptr null, align 1684 br label %bb485}86 87declare i32 @xxGetOffsetForCode(...)88 89declare i32 @xxCalculateMidType(...)90