23 lines · plain
1target datalayout = "E-p:64:64:64-i1:8:8-i8:8:8-i16:16:16-i32:32:32-i64:64:64-f32:32:32-f64:64:64-v128:128:128-n32:64"2target triple = "powerpc64-unknown-linux-gnu"3; RUN: llc -verify-machineinstrs -mcpu=a2 -enable-misched -enable-aa-sched-mi < %s | FileCheck %s4 5define i8 @test1(ptr noalias %a, ptr noalias %b, ptr noalias %c) nounwind {6entry:7 %q = load i8, ptr %b8 call void @llvm.prefetch(ptr %a, i32 0, i32 3, i32 1)9 %r = load i8, ptr %c10 %s = add i8 %q, %r11 ret i8 %s12}13 14declare void @llvm.prefetch(ptr, i32, i32, i32)15 16; Test that we've moved the second load to before the dcbt to better17; hide its latency.18; CHECK: @test119; CHECK: lbz20; CHECK: lbz21; CHECK: dcbt22 23