35 lines · plain
1; RUN: opt < %s -passes=loop-vectorize -mtriple x86_64 -debug -disable-output 2>&1 | FileCheck %s2; REQUIRES: asserts3 4; Check that cost model is not executed twice for VF=2 when vectorization is5; forced for a particular loop.6 7; CHECK: Cost of {{.*}} for VF 2: WIDEN {{.*}} = load8; CHECK: Cost of {{.*}} for VF 2: WIDEN store9; CHECK-NOT: Cost of {{.*}} for VF 2: WIDEN {{.*}} = load10; CHECK-NOT: Cost of {{.*}} for VF 2: WIDEN store11; CHECK: Cost for VF 2: 5 (Estimated cost per lane: 2.12 13define i32 @foo(ptr %A, i32 %n) {14entry:15 %cmp3.i = icmp eq i32 %n, 016 br i1 %cmp3.i, label %exit, label %for.body.i17 18for.body.i:19 %iv = phi i32 [ %add.i, %for.body.i ], [ 0, %entry ]20 %ld_addr = getelementptr inbounds i32, ptr %A, i32 %iv21 %0 = load i32, ptr %ld_addr, align 422 %val = add i32 %0, 123 store i32 %val, ptr %ld_addr, align 424 %add.i = add nsw i32 %iv, 125 %cmp.i = icmp eq i32 %add.i, %n26 br i1 %cmp.i, label %exit, label %for.body.i, !llvm.loop !027 28exit:29 %__init.addr.0.lcssa.i = phi i32 [ 0, %entry ], [ %add.i, %for.body.i ]30 ret i32 %__init.addr.0.lcssa.i31}32 33!0 = !{!0, !1}34!1 = !{!"llvm.loop.vectorize.enable", i1 true}35