// NOTE: Assertions have been autogenerated by utils/update_cc_test_checks.py // REQUIRES: aarch64-registered-target // RUN: %clang_cc1 -triple aarch64 -target-feature +sme-mop4 -target-feature +sme-f16f16 -target-feature +sme-i16i64 -target-feature +sme-b16b16 -target-feature +sme-f64f64 -target-feature +sme -target-feature +sme2 -disable-O0-optnone -Werror -Wall -emit-llvm -o - %s | opt -S -p mem2reg,instcombine,tailcallelim | FileCheck %s // RUN: %clang_cc1 -triple aarch64 -target-feature +sme-mop4 -target-feature +sme-f16f16 -target-feature +sme-i16i64 -target-feature +sme-b16b16 -target-feature +sme-f64f64 -target-feature +sme -target-feature +sme2 -disable-O0-optnone -Werror -Wall -emit-llvm -o - -x c++ %s | opt -S -p mem2reg,instcombine,tailcallelim | FileCheck %s -check-prefix=CPP-CHECK // RUN: %clang_cc1 -DSME_OVERLOADED_FORMS -triple aarch64 -target-feature +sme-mop4 -target-feature +sme-f16f16 -target-feature +sme-i16i64 -target-feature +sme-b16b16 -target-feature +sme-f64f64 -target-feature +sme -target-feature +sme2 -disable-O0-optnone -Werror -Wall -emit-llvm -o - %s | opt -S -p mem2reg,instcombine,tailcallelim | FileCheck %s // RUN: %clang_cc1 -DSME_OVERLOADED_FORMS -triple aarch64 -target-feature +sme-mop4 -target-feature +sme-f16f16 -target-feature +sme-i16i64 -target-feature +sme-b16b16 -target-feature +sme-f64f64 -target-feature +sme -target-feature +sme2 -disable-O0-optnone -Werror -Wall -emit-llvm -o - -x c++ %s | opt -S -p mem2reg,instcombine,tailcallelim | FileCheck %s -check-prefix=CPP-CHECK // RUN: %clang_cc1 -triple aarch64 -target-feature +sme-mop4 -target-feature +sme-f16f16 -target-feature +sme-i16i64 -target-feature +sme-b16b16 -target-feature +sme-f64f64 -target-feature +sme -target-feature +sme2 -S -disable-O0-optnone -Werror -Wall -o /dev/null %s #include #ifdef SME_OVERLOADED_FORMS #define SME_ACLE_FUNC(A1,A2_UNUSED,A3, A4_UNUSED) A1##A3 #else #define SME_ACLE_FUNC(A1,A2,A3,A4) A1##A2##A3##A4 #endif // CHECK-LABEL: @test_svmop4a_2x2_za32_s8_s8( // CHECK-NEXT: entry: // CHECK-NEXT: tail call void @llvm.aarch64.sme.smop4a.wide.2x2.nxv16i8(i32 1, [[ZN_COERCE0:%.*]], [[ZN_COERCE1:%.*]], [[ZM_COERCE0:%.*]], [[ZM_COERCE1:%.*]]) // CHECK-NEXT: ret void // // CPP-CHECK-LABEL: @_Z27test_svmop4a_2x2_za32_s8_s810svint8x2_tS_( // CPP-CHECK-NEXT: entry: // CPP-CHECK-NEXT: tail call void @llvm.aarch64.sme.smop4a.wide.2x2.nxv16i8(i32 1, [[ZN_COERCE0:%.*]], [[ZN_COERCE1:%.*]], [[ZM_COERCE0:%.*]], [[ZM_COERCE1:%.*]]) // CPP-CHECK-NEXT: ret void // void test_svmop4a_2x2_za32_s8_s8(svint8x2_t zn, svint8x2_t zm) __arm_streaming __arm_inout("za") { SME_ACLE_FUNC(svmop4a,_2x2,_za32,_s8_s8)(1, zn, zm); } // CHECK-LABEL: @test_svmop4s_2x2_za32_s8_s8( // CHECK-NEXT: entry: // CHECK-NEXT: tail call void @llvm.aarch64.sme.smop4s.wide.2x2.nxv16i8(i32 1, [[ZN_COERCE0:%.*]], [[ZN_COERCE1:%.*]], [[ZM_COERCE0:%.*]], [[ZM_COERCE1:%.*]]) // CHECK-NEXT: ret void // // CPP-CHECK-LABEL: @_Z27test_svmop4s_2x2_za32_s8_s810svint8x2_tS_( // CPP-CHECK-NEXT: entry: // CPP-CHECK-NEXT: tail call void @llvm.aarch64.sme.smop4s.wide.2x2.nxv16i8(i32 1, [[ZN_COERCE0:%.*]], [[ZN_COERCE1:%.*]], [[ZM_COERCE0:%.*]], [[ZM_COERCE1:%.*]]) // CPP-CHECK-NEXT: ret void // void test_svmop4s_2x2_za32_s8_s8(svint8x2_t zn, svint8x2_t zm) __arm_streaming __arm_inout("za") { SME_ACLE_FUNC(svmop4s,_2x2,_za32,_s8_s8)(1, zn, zm); } // CHECK-LABEL: @test_svmop4a_2x2_za32_u8_u8( // CHECK-NEXT: entry: // CHECK-NEXT: tail call void @llvm.aarch64.sme.umop4a.wide.2x2.nxv16i8(i32 1, [[ZN_COERCE0:%.*]], [[ZN_COERCE1:%.*]], [[ZM_COERCE0:%.*]], [[ZM_COERCE1:%.*]]) // CHECK-NEXT: ret void // // CPP-CHECK-LABEL: @_Z27test_svmop4a_2x2_za32_u8_u811svuint8x2_tS_( // CPP-CHECK-NEXT: entry: // CPP-CHECK-NEXT: tail call void @llvm.aarch64.sme.umop4a.wide.2x2.nxv16i8(i32 1, [[ZN_COERCE0:%.*]], [[ZN_COERCE1:%.*]], [[ZM_COERCE0:%.*]], [[ZM_COERCE1:%.*]]) // CPP-CHECK-NEXT: ret void // void test_svmop4a_2x2_za32_u8_u8(svuint8x2_t zn, svuint8x2_t zm) __arm_streaming __arm_inout("za") { SME_ACLE_FUNC(svmop4a,_2x2,_za32,_u8_u8)(1, zn, zm); } // CHECK-LABEL: @test_svmop4s_2x2_za32_u8_u8( // CHECK-NEXT: entry: // CHECK-NEXT: tail call void @llvm.aarch64.sme.umop4s.wide.2x2.nxv16i8(i32 1, [[ZN_COERCE0:%.*]], [[ZN_COERCE1:%.*]], [[ZM_COERCE0:%.*]], [[ZM_COERCE1:%.*]]) // CHECK-NEXT: ret void // // CPP-CHECK-LABEL: @_Z27test_svmop4s_2x2_za32_u8_u811svuint8x2_tS_( // CPP-CHECK-NEXT: entry: // CPP-CHECK-NEXT: tail call void @llvm.aarch64.sme.umop4s.wide.2x2.nxv16i8(i32 1, [[ZN_COERCE0:%.*]], [[ZN_COERCE1:%.*]], [[ZM_COERCE0:%.*]], [[ZM_COERCE1:%.*]]) // CPP-CHECK-NEXT: ret void // void test_svmop4s_2x2_za32_u8_u8(svuint8x2_t zn, svuint8x2_t zm) __arm_streaming __arm_inout("za") { SME_ACLE_FUNC(svmop4s,_2x2,_za32,_u8_u8)(1, zn, zm); } // CHECK-LABEL: @test_svmop4a_2x2_za32_s8_u8( // CHECK-NEXT: entry: // CHECK-NEXT: tail call void @llvm.aarch64.sme.sumop4a.wide.2x2.nxv16i8(i32 1, [[ZN_COERCE0:%.*]], [[ZN_COERCE1:%.*]], [[ZM_COERCE0:%.*]], [[ZM_COERCE1:%.*]]) // CHECK-NEXT: ret void // // CPP-CHECK-LABEL: @_Z27test_svmop4a_2x2_za32_s8_u810svint8x2_t11svuint8x2_t( // CPP-CHECK-NEXT: entry: // CPP-CHECK-NEXT: tail call void @llvm.aarch64.sme.sumop4a.wide.2x2.nxv16i8(i32 1, [[ZN_COERCE0:%.*]], [[ZN_COERCE1:%.*]], [[ZM_COERCE0:%.*]], [[ZM_COERCE1:%.*]]) // CPP-CHECK-NEXT: ret void // void test_svmop4a_2x2_za32_s8_u8(svint8x2_t zn, svuint8x2_t zm) __arm_streaming __arm_inout("za") { SME_ACLE_FUNC(svmop4a,_2x2,_za32,_s8_u8)(1, zn, zm); } // CHECK-LABEL: @test_svmop4s_2x2_za32_s8_u8( // CHECK-NEXT: entry: // CHECK-NEXT: tail call void @llvm.aarch64.sme.sumop4s.wide.2x2.nxv16i8(i32 1, [[ZN_COERCE0:%.*]], [[ZN_COERCE1:%.*]], [[ZM_COERCE0:%.*]], [[ZM_COERCE1:%.*]]) // CHECK-NEXT: ret void // // CPP-CHECK-LABEL: @_Z27test_svmop4s_2x2_za32_s8_u810svint8x2_t11svuint8x2_t( // CPP-CHECK-NEXT: entry: // CPP-CHECK-NEXT: tail call void @llvm.aarch64.sme.sumop4s.wide.2x2.nxv16i8(i32 1, [[ZN_COERCE0:%.*]], [[ZN_COERCE1:%.*]], [[ZM_COERCE0:%.*]], [[ZM_COERCE1:%.*]]) // CPP-CHECK-NEXT: ret void // void test_svmop4s_2x2_za32_s8_u8(svint8x2_t zn, svuint8x2_t zm) __arm_streaming __arm_inout("za") { SME_ACLE_FUNC(svmop4s,_2x2,_za32,_s8_u8)(1, zn, zm); } // CHECK-LABEL: @test_svmop4a_2x2_za32_u8_s8( // CHECK-NEXT: entry: // CHECK-NEXT: tail call void @llvm.aarch64.sme.usmop4a.wide.2x2.nxv16i8(i32 1, [[ZN_COERCE0:%.*]], [[ZN_COERCE1:%.*]], [[ZM_COERCE0:%.*]], [[ZM_COERCE1:%.*]]) // CHECK-NEXT: ret void // // CPP-CHECK-LABEL: @_Z27test_svmop4a_2x2_za32_u8_s811svuint8x2_t10svint8x2_t( // CPP-CHECK-NEXT: entry: // CPP-CHECK-NEXT: tail call void @llvm.aarch64.sme.usmop4a.wide.2x2.nxv16i8(i32 1, [[ZN_COERCE0:%.*]], [[ZN_COERCE1:%.*]], [[ZM_COERCE0:%.*]], [[ZM_COERCE1:%.*]]) // CPP-CHECK-NEXT: ret void // void test_svmop4a_2x2_za32_u8_s8(svuint8x2_t zn, svint8x2_t zm) __arm_streaming __arm_inout("za") { SME_ACLE_FUNC(svmop4a,_2x2,_za32,_u8_s8)(1, zn, zm); } // CHECK-LABEL: @test_svmop4s_2x2_za32_u8_s8( // CHECK-NEXT: entry: // CHECK-NEXT: tail call void @llvm.aarch64.sme.usmop4s.wide.2x2.nxv16i8(i32 1, [[ZN_COERCE0:%.*]], [[ZN_COERCE1:%.*]], [[ZM_COERCE0:%.*]], [[ZM_COERCE1:%.*]]) // CHECK-NEXT: ret void // // CPP-CHECK-LABEL: @_Z27test_svmop4s_2x2_za32_u8_s811svuint8x2_t10svint8x2_t( // CPP-CHECK-NEXT: entry: // CPP-CHECK-NEXT: tail call void @llvm.aarch64.sme.usmop4s.wide.2x2.nxv16i8(i32 1, [[ZN_COERCE0:%.*]], [[ZN_COERCE1:%.*]], [[ZM_COERCE0:%.*]], [[ZM_COERCE1:%.*]]) // CPP-CHECK-NEXT: ret void // void test_svmop4s_2x2_za32_u8_s8(svuint8x2_t zn, svint8x2_t zm) __arm_streaming __arm_inout("za") { SME_ACLE_FUNC(svmop4s,_2x2,_za32,_u8_s8)(1, zn, zm); } // CHECK-LABEL: @test_svmop4a_2x2_za32_s16_s16( // CHECK-NEXT: entry: // CHECK-NEXT: tail call void @llvm.aarch64.sme.smop4a.wide.2x2.nxv8i16(i32 1, [[ZN_COERCE0:%.*]], [[ZN_COERCE1:%.*]], [[ZM_COERCE0:%.*]], [[ZM_COERCE1:%.*]]) // CHECK-NEXT: ret void // // CPP-CHECK-LABEL: @_Z29test_svmop4a_2x2_za32_s16_s1611svint16x2_tS_( // CPP-CHECK-NEXT: entry: // CPP-CHECK-NEXT: tail call void @llvm.aarch64.sme.smop4a.wide.2x2.nxv8i16(i32 1, [[ZN_COERCE0:%.*]], [[ZN_COERCE1:%.*]], [[ZM_COERCE0:%.*]], [[ZM_COERCE1:%.*]]) // CPP-CHECK-NEXT: ret void // void test_svmop4a_2x2_za32_s16_s16(svint16x2_t zn, svint16x2_t zm) __arm_streaming __arm_inout("za") { SME_ACLE_FUNC(svmop4a,_2x2,_za32,_s16_s16)(1, zn, zm); } // CHECK-LABEL: @test_svmop4s_2x2_za32_s16_s16( // CHECK-NEXT: entry: // CHECK-NEXT: tail call void @llvm.aarch64.sme.smop4s.wide.2x2.nxv8i16(i32 1, [[ZN_COERCE0:%.*]], [[ZN_COERCE1:%.*]], [[ZM_COERCE0:%.*]], [[ZM_COERCE1:%.*]]) // CHECK-NEXT: ret void // // CPP-CHECK-LABEL: @_Z29test_svmop4s_2x2_za32_s16_s1611svint16x2_tS_( // CPP-CHECK-NEXT: entry: // CPP-CHECK-NEXT: tail call void @llvm.aarch64.sme.smop4s.wide.2x2.nxv8i16(i32 1, [[ZN_COERCE0:%.*]], [[ZN_COERCE1:%.*]], [[ZM_COERCE0:%.*]], [[ZM_COERCE1:%.*]]) // CPP-CHECK-NEXT: ret void // void test_svmop4s_2x2_za32_s16_s16(svint16x2_t zn, svint16x2_t zm) __arm_streaming __arm_inout("za") { SME_ACLE_FUNC(svmop4s,_2x2,_za32,_s16_s16)(1, zn, zm); } // CHECK-LABEL: @test_svmop4a_2x2_za32_u16_u16( // CHECK-NEXT: entry: // CHECK-NEXT: tail call void @llvm.aarch64.sme.umop4a.wide.2x2.nxv8i16(i32 1, [[ZN_COERCE0:%.*]], [[ZN_COERCE1:%.*]], [[ZM_COERCE0:%.*]], [[ZM_COERCE1:%.*]]) // CHECK-NEXT: ret void // // CPP-CHECK-LABEL: @_Z29test_svmop4a_2x2_za32_u16_u1612svuint16x2_tS_( // CPP-CHECK-NEXT: entry: // CPP-CHECK-NEXT: tail call void @llvm.aarch64.sme.umop4a.wide.2x2.nxv8i16(i32 1, [[ZN_COERCE0:%.*]], [[ZN_COERCE1:%.*]], [[ZM_COERCE0:%.*]], [[ZM_COERCE1:%.*]]) // CPP-CHECK-NEXT: ret void // void test_svmop4a_2x2_za32_u16_u16(svuint16x2_t zn, svuint16x2_t zm) __arm_streaming __arm_inout("za") { SME_ACLE_FUNC(svmop4a,_2x2,_za32,_u16_u16)(1, zn, zm); } // CHECK-LABEL: @test_svmop4s_2x2_za32_u16_u16( // CHECK-NEXT: entry: // CHECK-NEXT: tail call void @llvm.aarch64.sme.umop4s.wide.2x2.nxv8i16(i32 1, [[ZN_COERCE0:%.*]], [[ZN_COERCE1:%.*]], [[ZM_COERCE0:%.*]], [[ZM_COERCE1:%.*]]) // CHECK-NEXT: ret void // // CPP-CHECK-LABEL: @_Z29test_svmop4s_2x2_za32_u16_u1612svuint16x2_tS_( // CPP-CHECK-NEXT: entry: // CPP-CHECK-NEXT: tail call void @llvm.aarch64.sme.umop4s.wide.2x2.nxv8i16(i32 1, [[ZN_COERCE0:%.*]], [[ZN_COERCE1:%.*]], [[ZM_COERCE0:%.*]], [[ZM_COERCE1:%.*]]) // CPP-CHECK-NEXT: ret void // void test_svmop4s_2x2_za32_u16_u16(svuint16x2_t zn, svuint16x2_t zm) __arm_streaming __arm_inout("za") { SME_ACLE_FUNC(svmop4s,_2x2,_za32,_u16_u16)(1, zn, zm); } // CHECK-LABEL: @test_svmop4a_2x2_za32_f16_f16( // CHECK-NEXT: entry: // CHECK-NEXT: tail call void @llvm.aarch64.sme.mop4a.wide.2x2.nxv8f16(i32 1, [[ZN_COERCE0:%.*]], [[ZN_COERCE1:%.*]], [[ZM_COERCE0:%.*]], [[ZM_COERCE1:%.*]]) // CHECK-NEXT: ret void // // CPP-CHECK-LABEL: @_Z29test_svmop4a_2x2_za32_f16_f1613svfloat16x2_tS_( // CPP-CHECK-NEXT: entry: // CPP-CHECK-NEXT: tail call void @llvm.aarch64.sme.mop4a.wide.2x2.nxv8f16(i32 1, [[ZN_COERCE0:%.*]], [[ZN_COERCE1:%.*]], [[ZM_COERCE0:%.*]], [[ZM_COERCE1:%.*]]) // CPP-CHECK-NEXT: ret void // void test_svmop4a_2x2_za32_f16_f16(svfloat16x2_t zn, svfloat16x2_t zm) __arm_streaming __arm_inout("za") { SME_ACLE_FUNC(svmop4a,_2x2,_za32,_f16_f16)(1, zn, zm); } // CHECK-LABEL: @test_svmop4s_2x2_za32_f16_f16( // CHECK-NEXT: entry: // CHECK-NEXT: tail call void @llvm.aarch64.sme.mop4s.wide.2x2.nxv8f16(i32 1, [[ZN_COERCE0:%.*]], [[ZN_COERCE1:%.*]], [[ZM_COERCE0:%.*]], [[ZM_COERCE1:%.*]]) // CHECK-NEXT: ret void // // CPP-CHECK-LABEL: @_Z29test_svmop4s_2x2_za32_f16_f1613svfloat16x2_tS_( // CPP-CHECK-NEXT: entry: // CPP-CHECK-NEXT: tail call void @llvm.aarch64.sme.mop4s.wide.2x2.nxv8f16(i32 1, [[ZN_COERCE0:%.*]], [[ZN_COERCE1:%.*]], [[ZM_COERCE0:%.*]], [[ZM_COERCE1:%.*]]) // CPP-CHECK-NEXT: ret void // void test_svmop4s_2x2_za32_f16_f16(svfloat16x2_t zn, svfloat16x2_t zm) __arm_streaming __arm_inout("za") { SME_ACLE_FUNC(svmop4s,_2x2,_za32,_f16_f16)(1, zn, zm); } // CHECK-LABEL: @test_svmop4a_2x2_za32_bf16_bf16( // CHECK-NEXT: entry: // CHECK-NEXT: tail call void @llvm.aarch64.sme.mop4a.wide.2x2.nxv8bf16(i32 1, [[ZN_COERCE0:%.*]], [[ZN_COERCE1:%.*]], [[ZM_COERCE0:%.*]], [[ZM_COERCE1:%.*]]) // CHECK-NEXT: ret void // // CPP-CHECK-LABEL: @_Z31test_svmop4a_2x2_za32_bf16_bf1614svbfloat16x2_tS_( // CPP-CHECK-NEXT: entry: // CPP-CHECK-NEXT: tail call void @llvm.aarch64.sme.mop4a.wide.2x2.nxv8bf16(i32 1, [[ZN_COERCE0:%.*]], [[ZN_COERCE1:%.*]], [[ZM_COERCE0:%.*]], [[ZM_COERCE1:%.*]]) // CPP-CHECK-NEXT: ret void // void test_svmop4a_2x2_za32_bf16_bf16(svbfloat16x2_t zn, svbfloat16x2_t zm) __arm_streaming __arm_inout("za") { SME_ACLE_FUNC(svmop4a,_2x2,_za32,_bf16_bf16)(1, zn, zm); } // CHECK-LABEL: @test_svmop4s_2x2_za32_bf16_bf16( // CHECK-NEXT: entry: // CHECK-NEXT: tail call void @llvm.aarch64.sme.mop4s.wide.2x2.nxv8bf16(i32 1, [[ZN_COERCE0:%.*]], [[ZN_COERCE1:%.*]], [[ZM_COERCE0:%.*]], [[ZM_COERCE1:%.*]]) // CHECK-NEXT: ret void // // CPP-CHECK-LABEL: @_Z31test_svmop4s_2x2_za32_bf16_bf1614svbfloat16x2_tS_( // CPP-CHECK-NEXT: entry: // CPP-CHECK-NEXT: tail call void @llvm.aarch64.sme.mop4s.wide.2x2.nxv8bf16(i32 1, [[ZN_COERCE0:%.*]], [[ZN_COERCE1:%.*]], [[ZM_COERCE0:%.*]], [[ZM_COERCE1:%.*]]) // CPP-CHECK-NEXT: ret void // void test_svmop4s_2x2_za32_bf16_bf16(svbfloat16x2_t zn, svbfloat16x2_t zm) __arm_streaming __arm_inout("za") { SME_ACLE_FUNC(svmop4s,_2x2,_za32,_bf16_bf16)(1, zn, zm); } // CHECK-LABEL: @test_svmop4a_2x2_za64_s16_s16( // CHECK-NEXT: entry: // CHECK-NEXT: tail call void @llvm.aarch64.sme.smop4a.za64.wide.2x2.nxv8i16(i32 1, [[ZN_COERCE0:%.*]], [[ZN_COERCE1:%.*]], [[ZM_COERCE0:%.*]], [[ZM_COERCE1:%.*]]) // CHECK-NEXT: ret void // // CPP-CHECK-LABEL: @_Z29test_svmop4a_2x2_za64_s16_s1611svint16x2_tS_( // CPP-CHECK-NEXT: entry: // CPP-CHECK-NEXT: tail call void @llvm.aarch64.sme.smop4a.za64.wide.2x2.nxv8i16(i32 1, [[ZN_COERCE0:%.*]], [[ZN_COERCE1:%.*]], [[ZM_COERCE0:%.*]], [[ZM_COERCE1:%.*]]) // CPP-CHECK-NEXT: ret void // void test_svmop4a_2x2_za64_s16_s16(svint16x2_t zn, svint16x2_t zm) __arm_streaming __arm_inout("za") { SME_ACLE_FUNC(svmop4a,_2x2,_za64,_s16_s16)(1, zn, zm); } // CHECK-LABEL: @test_svmop4s_2x2_za64_s16_s16( // CHECK-NEXT: entry: // CHECK-NEXT: tail call void @llvm.aarch64.sme.smop4s.za64.wide.2x2.nxv8i16(i32 1, [[ZN_COERCE0:%.*]], [[ZN_COERCE1:%.*]], [[ZM_COERCE0:%.*]], [[ZM_COERCE1:%.*]]) // CHECK-NEXT: ret void // // CPP-CHECK-LABEL: @_Z29test_svmop4s_2x2_za64_s16_s1611svint16x2_tS_( // CPP-CHECK-NEXT: entry: // CPP-CHECK-NEXT: tail call void @llvm.aarch64.sme.smop4s.za64.wide.2x2.nxv8i16(i32 1, [[ZN_COERCE0:%.*]], [[ZN_COERCE1:%.*]], [[ZM_COERCE0:%.*]], [[ZM_COERCE1:%.*]]) // CPP-CHECK-NEXT: ret void // void test_svmop4s_2x2_za64_s16_s16(svint16x2_t zn, svint16x2_t zm) __arm_streaming __arm_inout("za") { SME_ACLE_FUNC(svmop4s,_2x2,_za64,_s16_s16)(1, zn, zm); } // CHECK-LABEL: @test_svmop4a_2x2_za64_u16_u16( // CHECK-NEXT: entry: // CHECK-NEXT: tail call void @llvm.aarch64.sme.umop4a.za64.wide.2x2.nxv8i16(i32 1, [[ZN_COERCE0:%.*]], [[ZN_COERCE1:%.*]], [[ZM_COERCE0:%.*]], [[ZM_COERCE1:%.*]]) // CHECK-NEXT: ret void // // CPP-CHECK-LABEL: @_Z29test_svmop4a_2x2_za64_u16_u1612svuint16x2_tS_( // CPP-CHECK-NEXT: entry: // CPP-CHECK-NEXT: tail call void @llvm.aarch64.sme.umop4a.za64.wide.2x2.nxv8i16(i32 1, [[ZN_COERCE0:%.*]], [[ZN_COERCE1:%.*]], [[ZM_COERCE0:%.*]], [[ZM_COERCE1:%.*]]) // CPP-CHECK-NEXT: ret void // void test_svmop4a_2x2_za64_u16_u16(svuint16x2_t zn, svuint16x2_t zm) __arm_streaming __arm_inout("za") { SME_ACLE_FUNC(svmop4a,_2x2,_za64,_u16_u16)(1, zn, zm); } // CHECK-LABEL: @test_svmop4s_2x2_za64_u16_u16( // CHECK-NEXT: entry: // CHECK-NEXT: tail call void @llvm.aarch64.sme.umop4s.za64.wide.2x2.nxv8i16(i32 1, [[ZN_COERCE0:%.*]], [[ZN_COERCE1:%.*]], [[ZM_COERCE0:%.*]], [[ZM_COERCE1:%.*]]) // CHECK-NEXT: ret void // // CPP-CHECK-LABEL: @_Z29test_svmop4s_2x2_za64_u16_u1612svuint16x2_tS_( // CPP-CHECK-NEXT: entry: // CPP-CHECK-NEXT: tail call void @llvm.aarch64.sme.umop4s.za64.wide.2x2.nxv8i16(i32 1, [[ZN_COERCE0:%.*]], [[ZN_COERCE1:%.*]], [[ZM_COERCE0:%.*]], [[ZM_COERCE1:%.*]]) // CPP-CHECK-NEXT: ret void // void test_svmop4s_2x2_za64_u16_u16(svuint16x2_t zn, svuint16x2_t zm) __arm_streaming __arm_inout("za") { SME_ACLE_FUNC(svmop4s,_2x2,_za64,_u16_u16)(1, zn, zm); } // CHECK-LABEL: @test_svmop4a_2x2_za64_s16_u16( // CHECK-NEXT: entry: // CHECK-NEXT: tail call void @llvm.aarch64.sme.sumop4a.za64.wide.2x2.nxv8i16(i32 1, [[ZN_COERCE0:%.*]], [[ZN_COERCE1:%.*]], [[ZM_COERCE0:%.*]], [[ZM_COERCE1:%.*]]) // CHECK-NEXT: ret void // // CPP-CHECK-LABEL: @_Z29test_svmop4a_2x2_za64_s16_u1611svint16x2_t12svuint16x2_t( // CPP-CHECK-NEXT: entry: // CPP-CHECK-NEXT: tail call void @llvm.aarch64.sme.sumop4a.za64.wide.2x2.nxv8i16(i32 1, [[ZN_COERCE0:%.*]], [[ZN_COERCE1:%.*]], [[ZM_COERCE0:%.*]], [[ZM_COERCE1:%.*]]) // CPP-CHECK-NEXT: ret void // void test_svmop4a_2x2_za64_s16_u16(svint16x2_t zn, svuint16x2_t zm) __arm_streaming __arm_inout("za") { SME_ACLE_FUNC(svmop4a,_2x2,_za64,_s16_u16)(1, zn, zm); } // CHECK-LABEL: @test_svmop4s_2x2_za64_s16_u16( // CHECK-NEXT: entry: // CHECK-NEXT: tail call void @llvm.aarch64.sme.sumop4s.za64.wide.2x2.nxv8i16(i32 1, [[ZN_COERCE0:%.*]], [[ZN_COERCE1:%.*]], [[ZM_COERCE0:%.*]], [[ZM_COERCE1:%.*]]) // CHECK-NEXT: ret void // // CPP-CHECK-LABEL: @_Z29test_svmop4s_2x2_za64_s16_u1611svint16x2_t12svuint16x2_t( // CPP-CHECK-NEXT: entry: // CPP-CHECK-NEXT: tail call void @llvm.aarch64.sme.sumop4s.za64.wide.2x2.nxv8i16(i32 1, [[ZN_COERCE0:%.*]], [[ZN_COERCE1:%.*]], [[ZM_COERCE0:%.*]], [[ZM_COERCE1:%.*]]) // CPP-CHECK-NEXT: ret void // void test_svmop4s_2x2_za64_s16_u16(svint16x2_t zn, svuint16x2_t zm) __arm_streaming __arm_inout("za") { SME_ACLE_FUNC(svmop4s,_2x2,_za64,_s16_u16)(1, zn, zm); } // CHECK-LABEL: @test_svmop4a_2x2_za64_u16_s16( // CHECK-NEXT: entry: // CHECK-NEXT: tail call void @llvm.aarch64.sme.usmop4a.za64.wide.2x2.nxv8i16(i32 1, [[ZN_COERCE0:%.*]], [[ZN_COERCE1:%.*]], [[ZM_COERCE0:%.*]], [[ZM_COERCE1:%.*]]) // CHECK-NEXT: ret void // // CPP-CHECK-LABEL: @_Z29test_svmop4a_2x2_za64_u16_s1612svuint16x2_t11svint16x2_t( // CPP-CHECK-NEXT: entry: // CPP-CHECK-NEXT: tail call void @llvm.aarch64.sme.usmop4a.za64.wide.2x2.nxv8i16(i32 1, [[ZN_COERCE0:%.*]], [[ZN_COERCE1:%.*]], [[ZM_COERCE0:%.*]], [[ZM_COERCE1:%.*]]) // CPP-CHECK-NEXT: ret void // void test_svmop4a_2x2_za64_u16_s16(svuint16x2_t zn, svint16x2_t zm) __arm_streaming __arm_inout("za") { SME_ACLE_FUNC(svmop4a,_2x2,_za64,_u16_s16)(1, zn, zm); } // CHECK-LABEL: @test_svmop4s_2x2_za64_u16_s16( // CHECK-NEXT: entry: // CHECK-NEXT: tail call void @llvm.aarch64.sme.usmop4s.za64.wide.2x2.nxv8i16(i32 1, [[ZN_COERCE0:%.*]], [[ZN_COERCE1:%.*]], [[ZM_COERCE0:%.*]], [[ZM_COERCE1:%.*]]) // CHECK-NEXT: ret void // // CPP-CHECK-LABEL: @_Z29test_svmop4s_2x2_za64_u16_s1612svuint16x2_t11svint16x2_t( // CPP-CHECK-NEXT: entry: // CPP-CHECK-NEXT: tail call void @llvm.aarch64.sme.usmop4s.za64.wide.2x2.nxv8i16(i32 1, [[ZN_COERCE0:%.*]], [[ZN_COERCE1:%.*]], [[ZM_COERCE0:%.*]], [[ZM_COERCE1:%.*]]) // CPP-CHECK-NEXT: ret void // void test_svmop4s_2x2_za64_u16_s16(svuint16x2_t zn, svint16x2_t zm) __arm_streaming __arm_inout("za") { SME_ACLE_FUNC(svmop4s,_2x2,_za64,_u16_s16)(1, zn, zm); } // CHECK-LABEL: @test_svmop4a_2x2_za16_f16_f16( // CHECK-NEXT: entry: // CHECK-NEXT: tail call void @llvm.aarch64.sme.mop4a.2x2.nxv8f16(i32 1, [[ZN_COERCE0:%.*]], [[ZN_COERCE1:%.*]], [[ZM_COERCE0:%.*]], [[ZM_COERCE1:%.*]]) // CHECK-NEXT: ret void // // CPP-CHECK-LABEL: @_Z29test_svmop4a_2x2_za16_f16_f1613svfloat16x2_tS_( // CPP-CHECK-NEXT: entry: // CPP-CHECK-NEXT: tail call void @llvm.aarch64.sme.mop4a.2x2.nxv8f16(i32 1, [[ZN_COERCE0:%.*]], [[ZN_COERCE1:%.*]], [[ZM_COERCE0:%.*]], [[ZM_COERCE1:%.*]]) // CPP-CHECK-NEXT: ret void // void test_svmop4a_2x2_za16_f16_f16(svfloat16x2_t zn, svfloat16x2_t zm) __arm_streaming __arm_inout("za") { SME_ACLE_FUNC(svmop4a,_2x2,_za16,_f16_f16)(1, zn, zm); } // CHECK-LABEL: @test_svmop4s_2x2_za16_f16_f16( // CHECK-NEXT: entry: // CHECK-NEXT: tail call void @llvm.aarch64.sme.mop4s.2x2.nxv8f16(i32 1, [[ZN_COERCE0:%.*]], [[ZN_COERCE1:%.*]], [[ZM_COERCE0:%.*]], [[ZM_COERCE1:%.*]]) // CHECK-NEXT: ret void // // CPP-CHECK-LABEL: @_Z29test_svmop4s_2x2_za16_f16_f1613svfloat16x2_tS_( // CPP-CHECK-NEXT: entry: // CPP-CHECK-NEXT: tail call void @llvm.aarch64.sme.mop4s.2x2.nxv8f16(i32 1, [[ZN_COERCE0:%.*]], [[ZN_COERCE1:%.*]], [[ZM_COERCE0:%.*]], [[ZM_COERCE1:%.*]]) // CPP-CHECK-NEXT: ret void // void test_svmop4s_2x2_za16_f16_f16(svfloat16x2_t zn, svfloat16x2_t zm) __arm_streaming __arm_inout("za") { SME_ACLE_FUNC(svmop4s,_2x2,_za16,_f16_f16)(1, zn, zm); } // CHECK-LABEL: @test_svmop4a_2x2_za32_f32_f32( // CHECK-NEXT: entry: // CHECK-NEXT: tail call void @llvm.aarch64.sme.mop4a.2x2.nxv4f32(i32 1, [[ZN_COERCE0:%.*]], [[ZN_COERCE1:%.*]], [[ZM_COERCE0:%.*]], [[ZM_COERCE1:%.*]]) // CHECK-NEXT: ret void // // CPP-CHECK-LABEL: @_Z29test_svmop4a_2x2_za32_f32_f3213svfloat32x2_tS_( // CPP-CHECK-NEXT: entry: // CPP-CHECK-NEXT: tail call void @llvm.aarch64.sme.mop4a.2x2.nxv4f32(i32 1, [[ZN_COERCE0:%.*]], [[ZN_COERCE1:%.*]], [[ZM_COERCE0:%.*]], [[ZM_COERCE1:%.*]]) // CPP-CHECK-NEXT: ret void // void test_svmop4a_2x2_za32_f32_f32(svfloat32x2_t zn, svfloat32x2_t zm) __arm_streaming __arm_inout("za") { SME_ACLE_FUNC(svmop4a,_2x2,_za32,_f32_f32)(1, zn, zm); } // CHECK-LABEL: @test_svmop4s_2x2_za32_f32_f32( // CHECK-NEXT: entry: // CHECK-NEXT: tail call void @llvm.aarch64.sme.mop4s.2x2.nxv4f32(i32 1, [[ZN_COERCE0:%.*]], [[ZN_COERCE1:%.*]], [[ZM_COERCE0:%.*]], [[ZM_COERCE1:%.*]]) // CHECK-NEXT: ret void // // CPP-CHECK-LABEL: @_Z29test_svmop4s_2x2_za32_f32_f3213svfloat32x2_tS_( // CPP-CHECK-NEXT: entry: // CPP-CHECK-NEXT: tail call void @llvm.aarch64.sme.mop4s.2x2.nxv4f32(i32 1, [[ZN_COERCE0:%.*]], [[ZN_COERCE1:%.*]], [[ZM_COERCE0:%.*]], [[ZM_COERCE1:%.*]]) // CPP-CHECK-NEXT: ret void // void test_svmop4s_2x2_za32_f32_f32(svfloat32x2_t zn, svfloat32x2_t zm) __arm_streaming __arm_inout("za") { SME_ACLE_FUNC(svmop4s,_2x2,_za32,_f32_f32)(1, zn, zm); } // CHECK-LABEL: @test_svmop4a_2x2_za64_f64_f64( // CHECK-NEXT: entry: // CHECK-NEXT: tail call void @llvm.aarch64.sme.mop4a.2x2.nxv2f64(i32 1, [[ZN_COERCE0:%.*]], [[ZN_COERCE1:%.*]], [[ZM_COERCE0:%.*]], [[ZM_COERCE1:%.*]]) // CHECK-NEXT: ret void // // CPP-CHECK-LABEL: @_Z29test_svmop4a_2x2_za64_f64_f6413svfloat64x2_tS_( // CPP-CHECK-NEXT: entry: // CPP-CHECK-NEXT: tail call void @llvm.aarch64.sme.mop4a.2x2.nxv2f64(i32 1, [[ZN_COERCE0:%.*]], [[ZN_COERCE1:%.*]], [[ZM_COERCE0:%.*]], [[ZM_COERCE1:%.*]]) // CPP-CHECK-NEXT: ret void // void test_svmop4a_2x2_za64_f64_f64(svfloat64x2_t zn, svfloat64x2_t zm) __arm_streaming __arm_inout("za") { SME_ACLE_FUNC(svmop4a,_2x2,_za64,_f64_f64)(1, zn, zm); } // CHECK-LABEL: @test_svmop4s_2x2_za64_f64_f64( // CHECK-NEXT: entry: // CHECK-NEXT: tail call void @llvm.aarch64.sme.mop4s.2x2.nxv2f64(i32 1, [[ZN_COERCE0:%.*]], [[ZN_COERCE1:%.*]], [[ZM_COERCE0:%.*]], [[ZM_COERCE1:%.*]]) // CHECK-NEXT: ret void // // CPP-CHECK-LABEL: @_Z29test_svmop4s_2x2_za64_f64_f6413svfloat64x2_tS_( // CPP-CHECK-NEXT: entry: // CPP-CHECK-NEXT: tail call void @llvm.aarch64.sme.mop4s.2x2.nxv2f64(i32 1, [[ZN_COERCE0:%.*]], [[ZN_COERCE1:%.*]], [[ZM_COERCE0:%.*]], [[ZM_COERCE1:%.*]]) // CPP-CHECK-NEXT: ret void // void test_svmop4s_2x2_za64_f64_f64(svfloat64x2_t zn, svfloat64x2_t zm) __arm_streaming __arm_inout("za") { SME_ACLE_FUNC(svmop4s,_2x2,_za64,_f64_f64)(1, zn, zm); } // CHECK-LABEL: @test_svmop4a_2x2_za16_bf16_bf16( // CHECK-NEXT: entry: // CHECK-NEXT: tail call void @llvm.aarch64.sme.mop4a.2x2.nxv8bf16(i32 1, [[ZN_COERCE0:%.*]], [[ZN_COERCE1:%.*]], [[ZM_COERCE0:%.*]], [[ZM_COERCE1:%.*]]) // CHECK-NEXT: ret void // // CPP-CHECK-LABEL: @_Z31test_svmop4a_2x2_za16_bf16_bf1614svbfloat16x2_tS_( // CPP-CHECK-NEXT: entry: // CPP-CHECK-NEXT: tail call void @llvm.aarch64.sme.mop4a.2x2.nxv8bf16(i32 1, [[ZN_COERCE0:%.*]], [[ZN_COERCE1:%.*]], [[ZM_COERCE0:%.*]], [[ZM_COERCE1:%.*]]) // CPP-CHECK-NEXT: ret void // void test_svmop4a_2x2_za16_bf16_bf16(svbfloat16x2_t zn, svbfloat16x2_t zm) __arm_streaming __arm_inout("za") { SME_ACLE_FUNC(svmop4a,_2x2,_za16,_bf16_bf16)(1, zn, zm); } // CHECK-LABEL: @test_svmop4s_2x2_za16_bf16_bf16( // CHECK-NEXT: entry: // CHECK-NEXT: tail call void @llvm.aarch64.sme.mop4s.2x2.nxv8bf16(i32 1, [[ZN_COERCE0:%.*]], [[ZN_COERCE1:%.*]], [[ZM_COERCE0:%.*]], [[ZM_COERCE1:%.*]]) // CHECK-NEXT: ret void // // CPP-CHECK-LABEL: @_Z31test_svmop4s_2x2_za16_bf16_bf1614svbfloat16x2_tS_( // CPP-CHECK-NEXT: entry: // CPP-CHECK-NEXT: tail call void @llvm.aarch64.sme.mop4s.2x2.nxv8bf16(i32 1, [[ZN_COERCE0:%.*]], [[ZN_COERCE1:%.*]], [[ZM_COERCE0:%.*]], [[ZM_COERCE1:%.*]]) // CPP-CHECK-NEXT: ret void // void test_svmop4s_2x2_za16_bf16_bf16(svbfloat16x2_t zn, svbfloat16x2_t zm) __arm_streaming __arm_inout("za") { SME_ACLE_FUNC(svmop4s,_2x2,_za16,_bf16_bf16)(1, zn, zm); }