234 lines · plain
1; NOTE: Assertions have been autogenerated by utils/update_llc_test_checks.py UTC_ARGS: --version 62; RUN: llc -mtriple=x86_64-apple-macosx10.9 < %s | FileCheck %s3 4define { half, half } @test_sincospi_f16(half %a) #0 {5; CHECK-LABEL: test_sincospi_f16:6; CHECK: ## %bb.0:7; CHECK-NEXT: subq $40, %rsp8; CHECK-NEXT: pextrw $0, %xmm0, %eax9; CHECK-NEXT: movzwl %ax, %edi10; CHECK-NEXT: callq ___extendhfsf211; CHECK-NEXT: leaq {{[0-9]+}}(%rsp), %rdi12; CHECK-NEXT: leaq {{[0-9]+}}(%rsp), %rsi13; CHECK-NEXT: callq ___sincospif14; CHECK-NEXT: movd {{.*#+}} xmm0 = mem[0],zero,zero,zero15; CHECK-NEXT: callq ___truncsfhf216; CHECK-NEXT: ## kill: def $ax killed $ax def $eax17; CHECK-NEXT: pinsrw $0, %eax, %xmm018; CHECK-NEXT: movdqa %xmm0, {{[-0-9]+}}(%r{{[sb]}}p) ## 16-byte Spill19; CHECK-NEXT: movss {{.*#+}} xmm0 = mem[0],zero,zero,zero20; CHECK-NEXT: callq ___truncsfhf221; CHECK-NEXT: ## kill: def $ax killed $ax def $eax22; CHECK-NEXT: pinsrw $0, %eax, %xmm123; CHECK-NEXT: movaps {{[-0-9]+}}(%r{{[sb]}}p), %xmm0 ## 16-byte Reload24; CHECK-NEXT: addq $40, %rsp25; CHECK-NEXT: retq26 %result = call { half, half } @llvm.sincospi.f16(half %a)27 ret { half, half } %result28}29 30define half @test_sincospi_f16_only_use_sin(half %a) #0 {31; CHECK-LABEL: test_sincospi_f16_only_use_sin:32; CHECK: ## %bb.0:33; CHECK-NEXT: pushq %rax34; CHECK-NEXT: pextrw $0, %xmm0, %eax35; CHECK-NEXT: movzwl %ax, %edi36; CHECK-NEXT: callq ___extendhfsf237; CHECK-NEXT: movq %rsp, %rdi38; CHECK-NEXT: leaq {{[0-9]+}}(%rsp), %rsi39; CHECK-NEXT: callq ___sincospif40; CHECK-NEXT: movd {{.*#+}} xmm0 = mem[0],zero,zero,zero41; CHECK-NEXT: callq ___truncsfhf242; CHECK-NEXT: ## kill: def $ax killed $ax def $eax43; CHECK-NEXT: pinsrw $0, %eax, %xmm044; CHECK-NEXT: popq %rax45; CHECK-NEXT: retq46 %result = call { half, half } @llvm.sincospi.f16(half %a)47 %result.0 = extractvalue { half, half } %result, 048 ret half %result.049}50 51define half @test_sincospi_f16_only_use_cos(half %a) #0 {52; CHECK-LABEL: test_sincospi_f16_only_use_cos:53; CHECK: ## %bb.0:54; CHECK-NEXT: pushq %rax55; CHECK-NEXT: pextrw $0, %xmm0, %eax56; CHECK-NEXT: movzwl %ax, %edi57; CHECK-NEXT: callq ___extendhfsf258; CHECK-NEXT: leaq {{[0-9]+}}(%rsp), %rdi59; CHECK-NEXT: movq %rsp, %rsi60; CHECK-NEXT: callq ___sincospif61; CHECK-NEXT: movd {{.*#+}} xmm0 = mem[0],zero,zero,zero62; CHECK-NEXT: callq ___truncsfhf263; CHECK-NEXT: ## kill: def $ax killed $ax def $eax64; CHECK-NEXT: pinsrw $0, %eax, %xmm065; CHECK-NEXT: popq %rax66; CHECK-NEXT: retq67 %result = call { half, half } @llvm.sincospi.f16(half %a)68 %result.1 = extractvalue { half, half } %result, 169 ret half %result.170}71 72define { <2 x half>, <2 x half> } @test_sincospi_v2f16(<2 x half> %a) #0 {73; CHECK-LABEL: test_sincospi_v2f16:74; CHECK: ## %bb.0:75; CHECK-NEXT: pushq %rbx76; CHECK-NEXT: subq $64, %rsp77; CHECK-NEXT: pextrw $0, %xmm0, %ebx78; CHECK-NEXT: psrld $16, %xmm079; CHECK-NEXT: pextrw $0, %xmm0, %eax80; CHECK-NEXT: movzwl %ax, %edi81; CHECK-NEXT: callq ___extendhfsf282; CHECK-NEXT: leaq {{[0-9]+}}(%rsp), %rdi83; CHECK-NEXT: movq %rsp, %rsi84; CHECK-NEXT: callq ___sincospif85; CHECK-NEXT: movzwl %bx, %edi86; CHECK-NEXT: callq ___extendhfsf287; CHECK-NEXT: leaq {{[0-9]+}}(%rsp), %rdi88; CHECK-NEXT: leaq {{[0-9]+}}(%rsp), %rsi89; CHECK-NEXT: callq ___sincospif90; CHECK-NEXT: movd {{.*#+}} xmm0 = mem[0],zero,zero,zero91; CHECK-NEXT: callq ___truncsfhf292; CHECK-NEXT: ## kill: def $ax killed $ax def $eax93; CHECK-NEXT: pinsrw $0, %eax, %xmm094; CHECK-NEXT: movdqa %xmm0, {{[-0-9]+}}(%r{{[sb]}}p) ## 16-byte Spill95; CHECK-NEXT: movd {{.*#+}} xmm0 = mem[0],zero,zero,zero96; CHECK-NEXT: callq ___truncsfhf297; CHECK-NEXT: ## kill: def $ax killed $ax def $eax98; CHECK-NEXT: pinsrw $0, %eax, %xmm099; CHECK-NEXT: movdqa %xmm0, {{[-0-9]+}}(%r{{[sb]}}p) ## 16-byte Spill100; CHECK-NEXT: movd {{.*#+}} xmm0 = mem[0],zero,zero,zero101; CHECK-NEXT: callq ___truncsfhf2102; CHECK-NEXT: ## kill: def $ax killed $ax def $eax103; CHECK-NEXT: pinsrw $0, %eax, %xmm0104; CHECK-NEXT: movdqa %xmm0, {{[-0-9]+}}(%r{{[sb]}}p) ## 16-byte Spill105; CHECK-NEXT: movd {{.*#+}} xmm0 = mem[0],zero,zero,zero106; CHECK-NEXT: callq ___truncsfhf2107; CHECK-NEXT: ## kill: def $ax killed $ax def $eax108; CHECK-NEXT: pinsrw $0, %eax, %xmm0109; CHECK-NEXT: punpcklwd {{[-0-9]+}}(%r{{[sb]}}p), %xmm0 ## 16-byte Folded Reload110; CHECK-NEXT: ## xmm0 = xmm0[0],mem[0],xmm0[1],mem[1],xmm0[2],mem[2],xmm0[3],mem[3]111; CHECK-NEXT: movdqa {{[-0-9]+}}(%r{{[sb]}}p), %xmm1 ## 16-byte Reload112; CHECK-NEXT: punpcklwd {{[-0-9]+}}(%r{{[sb]}}p), %xmm1 ## 16-byte Folded Reload113; CHECK-NEXT: ## xmm1 = xmm1[0],mem[0],xmm1[1],mem[1],xmm1[2],mem[2],xmm1[3],mem[3]114; CHECK-NEXT: addq $64, %rsp115; CHECK-NEXT: popq %rbx116; CHECK-NEXT: retq117 %result = call { <2 x half>, <2 x half> } @llvm.sincospi.v2f16(<2 x half> %a)118 ret { <2 x half>, <2 x half> } %result119}120 121define { float, float } @test_sincospi_f32(float %a) #0 {122; CHECK-LABEL: test_sincospi_f32:123; CHECK: ## %bb.0:124; CHECK-NEXT: pushq %rax125; CHECK-NEXT: leaq {{[0-9]+}}(%rsp), %rdi126; CHECK-NEXT: movq %rsp, %rsi127; CHECK-NEXT: callq ___sincospif128; CHECK-NEXT: movss {{.*#+}} xmm0 = mem[0],zero,zero,zero129; CHECK-NEXT: movss {{.*#+}} xmm1 = mem[0],zero,zero,zero130; CHECK-NEXT: popq %rax131; CHECK-NEXT: retq132 %result = call { float, float } @llvm.sincospi.f32(float %a)133 ret { float, float } %result134}135 136define { <2 x float>, <2 x float> } @test_sincospi_v2f32(<2 x float> %a) #0 {137; CHECK-LABEL: test_sincospi_v2f32:138; CHECK: ## %bb.0:139; CHECK-NEXT: subq $40, %rsp140; CHECK-NEXT: movaps %xmm0, {{[-0-9]+}}(%r{{[sb]}}p) ## 16-byte Spill141; CHECK-NEXT: leaq {{[0-9]+}}(%rsp), %rdi142; CHECK-NEXT: movq %rsp, %rsi143; CHECK-NEXT: callq ___sincospif144; CHECK-NEXT: movaps {{[-0-9]+}}(%r{{[sb]}}p), %xmm0 ## 16-byte Reload145; CHECK-NEXT: shufps {{.*#+}} xmm0 = xmm0[1,1,1,1]146; CHECK-NEXT: leaq {{[0-9]+}}(%rsp), %rdi147; CHECK-NEXT: leaq {{[0-9]+}}(%rsp), %rsi148; CHECK-NEXT: callq ___sincospif149; CHECK-NEXT: movss {{.*#+}} xmm0 = mem[0],zero,zero,zero150; CHECK-NEXT: movss {{.*#+}} xmm1 = mem[0],zero,zero,zero151; CHECK-NEXT: unpcklps {{.*#+}} xmm0 = xmm0[0],xmm1[0],xmm0[1],xmm1[1]152; CHECK-NEXT: movss {{.*#+}} xmm1 = mem[0],zero,zero,zero153; CHECK-NEXT: movss {{.*#+}} xmm2 = mem[0],zero,zero,zero154; CHECK-NEXT: unpcklps {{.*#+}} xmm1 = xmm1[0],xmm2[0],xmm1[1],xmm2[1]155; CHECK-NEXT: addq $40, %rsp156; CHECK-NEXT: retq157 %result = call { <2 x float>, <2 x float> } @llvm.sincospi.v2f32(<2 x float> %a)158 ret { <2 x float>, <2 x float> } %result159}160 161define { <3 x float>, <3 x float> } @test_sincospi_v3f32(<3 x float> %a) #0 {162; CHECK-LABEL: test_sincospi_v3f32:163; CHECK: ## %bb.0:164; CHECK-NEXT: subq $56, %rsp165; CHECK-NEXT: movaps %xmm0, {{[-0-9]+}}(%r{{[sb]}}p) ## 16-byte Spill166; CHECK-NEXT: leaq {{[0-9]+}}(%rsp), %rdi167; CHECK-NEXT: leaq {{[0-9]+}}(%rsp), %rsi168; CHECK-NEXT: callq ___sincospif169; CHECK-NEXT: movaps {{[-0-9]+}}(%r{{[sb]}}p), %xmm0 ## 16-byte Reload170; CHECK-NEXT: shufps {{.*#+}} xmm0 = xmm0[1,1,1,1]171; CHECK-NEXT: leaq {{[0-9]+}}(%rsp), %rdi172; CHECK-NEXT: leaq {{[0-9]+}}(%rsp), %rsi173; CHECK-NEXT: callq ___sincospif174; CHECK-NEXT: movaps {{[-0-9]+}}(%r{{[sb]}}p), %xmm0 ## 16-byte Reload175; CHECK-NEXT: movhlps {{.*#+}} xmm0 = xmm0[1,1]176; CHECK-NEXT: leaq {{[0-9]+}}(%rsp), %rdi177; CHECK-NEXT: leaq {{[0-9]+}}(%rsp), %rsi178; CHECK-NEXT: callq ___sincospif179; CHECK-NEXT: movss {{.*#+}} xmm0 = mem[0],zero,zero,zero180; CHECK-NEXT: movss {{.*#+}} xmm1 = mem[0],zero,zero,zero181; CHECK-NEXT: unpcklps {{.*#+}} xmm0 = xmm0[0],xmm1[0],xmm0[1],xmm1[1]182; CHECK-NEXT: movss {{.*#+}} xmm1 = mem[0],zero,zero,zero183; CHECK-NEXT: movlhps {{.*#+}} xmm0 = xmm0[0],xmm1[0]184; CHECK-NEXT: movss {{.*#+}} xmm1 = mem[0],zero,zero,zero185; CHECK-NEXT: movss {{.*#+}} xmm2 = mem[0],zero,zero,zero186; CHECK-NEXT: unpcklps {{.*#+}} xmm1 = xmm1[0],xmm2[0],xmm1[1],xmm2[1]187; CHECK-NEXT: movss {{.*#+}} xmm2 = mem[0],zero,zero,zero188; CHECK-NEXT: movlhps {{.*#+}} xmm1 = xmm1[0],xmm2[0]189; CHECK-NEXT: addq $56, %rsp190; CHECK-NEXT: retq191 %result = call { <3 x float>, <3 x float> } @llvm.sincospi.v3f32(<3 x float> %a)192 ret { <3 x float>, <3 x float> } %result193}194 195define { double, double } @test_sincospi_f64(double %a) #0 {196; CHECK-LABEL: test_sincospi_f64:197; CHECK: ## %bb.0:198; CHECK-NEXT: subq $24, %rsp199; CHECK-NEXT: leaq {{[0-9]+}}(%rsp), %rdi200; CHECK-NEXT: leaq {{[0-9]+}}(%rsp), %rsi201; CHECK-NEXT: callq ___sincospi202; CHECK-NEXT: movsd {{.*#+}} xmm0 = mem[0],zero203; CHECK-NEXT: movsd {{.*#+}} xmm1 = mem[0],zero204; CHECK-NEXT: addq $24, %rsp205; CHECK-NEXT: retq206 %result = call { double, double } @llvm.sincospi.f64(double %a)207 ret { double, double } %result208}209 210define { <2 x double>, <2 x double> } @test_sincospi_v2f64(<2 x double> %a) #0 {211; CHECK-LABEL: test_sincospi_v2f64:212; CHECK: ## %bb.0:213; CHECK-NEXT: subq $56, %rsp214; CHECK-NEXT: movaps %xmm0, {{[-0-9]+}}(%r{{[sb]}}p) ## 16-byte Spill215; CHECK-NEXT: leaq {{[0-9]+}}(%rsp), %rdi216; CHECK-NEXT: leaq {{[0-9]+}}(%rsp), %rsi217; CHECK-NEXT: callq ___sincospi218; CHECK-NEXT: movaps {{[-0-9]+}}(%r{{[sb]}}p), %xmm0 ## 16-byte Reload219; CHECK-NEXT: movhlps {{.*#+}} xmm0 = xmm0[1,1]220; CHECK-NEXT: leaq {{[0-9]+}}(%rsp), %rdi221; CHECK-NEXT: movq %rsp, %rsi222; CHECK-NEXT: callq ___sincospi223; CHECK-NEXT: movsd {{.*#+}} xmm0 = mem[0],zero224; CHECK-NEXT: movhps {{.*#+}} xmm0 = xmm0[0,1],mem[0,1]225; CHECK-NEXT: movsd {{.*#+}} xmm1 = mem[0],zero226; CHECK-NEXT: movhps {{.*#+}} xmm1 = xmm1[0,1],mem[0,1]227; CHECK-NEXT: addq $56, %rsp228; CHECK-NEXT: retq229 %result = call { <2 x double>, <2 x double> } @llvm.sincospi.v2f64(<2 x double> %a)230 ret { <2 x double>, <2 x double> } %result231}232 233attributes #0 = { nounwind }234