49 lines · plain
1; RUN: opt -passes=loop-load-elim -S < %s | FileCheck %s2 3; In this case the later store forward to the load:4;5; for (unsigned i = 0; i < 100; i++) {6; B[i] = A[i] + 1;7; A[i+1] = C[i] + 2;8; A[i+1] = D[i] + 3;9; }10 11target datalayout = "e-m:o-i64:64-f80:128-n8:16:32:64-S128"12 13define void @f(ptr noalias nocapture %A, ptr noalias nocapture readonly %B,14 ptr noalias nocapture %C, ptr noalias nocapture readonly %D,15 i64 %N) {16entry:17; CHECK: %load_initial = load i32, ptr %A18 br label %for.body19 20for.body: ; preds = %for.body, %entry21; CHECK: %store_forwarded = phi i32 [ %load_initial, %entry ], [ %addD, %for.body ]22 %indvars.iv = phi i64 [ 0, %entry ], [ %indvars.iv.next, %for.body ]23 %arrayidxA = getelementptr inbounds i32, ptr %A, i64 %indvars.iv24 %loadA = load i32, ptr %arrayidxA, align 425; CHECK: %addA = add i32 %store_forwarded, 126 %addA = add i32 %loadA, 127 28 %arrayidxB = getelementptr inbounds i32, ptr %B, i64 %indvars.iv29 store i32 %addA, ptr %arrayidxB, align 430 31 %arrayidxC = getelementptr inbounds i32, ptr %C, i64 %indvars.iv32 %loadC = load i32, ptr %arrayidxC, align 433 %addC = add i32 %loadC, 234 %indvars.iv.next = add nuw nsw i64 %indvars.iv, 135 %arrayidxA_next = getelementptr inbounds i32, ptr %A, i64 %indvars.iv.next36 store i32 %addC, ptr %arrayidxA_next, align 437 38 %arrayidxD = getelementptr inbounds i32, ptr %D, i64 %indvars.iv39 %loadD = load i32, ptr %arrayidxD, align 440 %addD = add i32 %loadD, 341 store i32 %addD, ptr %arrayidxA_next, align 442 43 %exitcond = icmp eq i64 %indvars.iv.next, %N44 br i1 %exitcond, label %for.end, label %for.body45 46for.end: ; preds = %for.body47 ret void48}49