wanglei a5c90e48b6
[LoongArch] Switch to the Machine Scheduler (#83759)
The SelectionDAG scheduling preference now becomes source order
scheduling (machine scheduler generates better code -- even without
there being a machine model defined for LoongArch yet).

Most of the test changes are trivial instruction reorderings and
differing register allocations, without any obvious performance impact.

This is similar to commit: 3d0fbafd0bce43bb9106230a45d1130f7a40e5ec
2024-03-05 09:15:44 +08:00

123 lines
3.5 KiB
LLVM

; NOTE: Assertions have been autogenerated by utils/update_llc_test_checks.py UTC_ARGS: --version 4
; RUN: llc --mtriple=loongarch64 --mattr=+lsx < %s | FileCheck %s
define void @sub_v16i8(ptr %res, ptr %a0, ptr %a1) nounwind {
; CHECK-LABEL: sub_v16i8:
; CHECK: # %bb.0: # %entry
; CHECK-NEXT: vld $vr0, $a1, 0
; CHECK-NEXT: vld $vr1, $a2, 0
; CHECK-NEXT: vsub.b $vr0, $vr0, $vr1
; CHECK-NEXT: vst $vr0, $a0, 0
; CHECK-NEXT: ret
entry:
%v0 = load <16 x i8>, ptr %a0
%v1 = load <16 x i8>, ptr %a1
%v2 = sub <16 x i8> %v0, %v1
store <16 x i8> %v2, ptr %res
ret void
}
define void @sub_v8i16(ptr %res, ptr %a0, ptr %a1) nounwind {
; CHECK-LABEL: sub_v8i16:
; CHECK: # %bb.0: # %entry
; CHECK-NEXT: vld $vr0, $a1, 0
; CHECK-NEXT: vld $vr1, $a2, 0
; CHECK-NEXT: vsub.h $vr0, $vr0, $vr1
; CHECK-NEXT: vst $vr0, $a0, 0
; CHECK-NEXT: ret
entry:
%v0 = load <8 x i16>, ptr %a0
%v1 = load <8 x i16>, ptr %a1
%v2 = sub <8 x i16> %v0, %v1
store <8 x i16> %v2, ptr %res
ret void
}
define void @sub_v4i32(ptr %res, ptr %a0, ptr %a1) nounwind {
; CHECK-LABEL: sub_v4i32:
; CHECK: # %bb.0: # %entry
; CHECK-NEXT: vld $vr0, $a1, 0
; CHECK-NEXT: vld $vr1, $a2, 0
; CHECK-NEXT: vsub.w $vr0, $vr0, $vr1
; CHECK-NEXT: vst $vr0, $a0, 0
; CHECK-NEXT: ret
entry:
%v0 = load <4 x i32>, ptr %a0
%v1 = load <4 x i32>, ptr %a1
%v2 = sub <4 x i32> %v0, %v1
store <4 x i32> %v2, ptr %res
ret void
}
define void @sub_v2i64(ptr %res, ptr %a0, ptr %a1) nounwind {
; CHECK-LABEL: sub_v2i64:
; CHECK: # %bb.0: # %entry
; CHECK-NEXT: vld $vr0, $a1, 0
; CHECK-NEXT: vld $vr1, $a2, 0
; CHECK-NEXT: vsub.d $vr0, $vr0, $vr1
; CHECK-NEXT: vst $vr0, $a0, 0
; CHECK-NEXT: ret
entry:
%v0 = load <2 x i64>, ptr %a0
%v1 = load <2 x i64>, ptr %a1
%v2 = sub <2 x i64> %v0, %v1
store <2 x i64> %v2, ptr %res
ret void
}
define void @sub_v16i8_31(ptr %res, ptr %a0) nounwind {
; CHECK-LABEL: sub_v16i8_31:
; CHECK: # %bb.0: # %entry
; CHECK-NEXT: vld $vr0, $a1, 0
; CHECK-NEXT: vsubi.bu $vr0, $vr0, 31
; CHECK-NEXT: vst $vr0, $a0, 0
; CHECK-NEXT: ret
entry:
%v0 = load <16 x i8>, ptr %a0
%v1 = sub <16 x i8> %v0, <i8 31, i8 31, i8 31, i8 31, i8 31, i8 31, i8 31, i8 31, i8 31, i8 31, i8 31, i8 31, i8 31, i8 31, i8 31, i8 31>
store <16 x i8> %v1, ptr %res
ret void
}
define void @sub_v8i16_31(ptr %res, ptr %a0) nounwind {
; CHECK-LABEL: sub_v8i16_31:
; CHECK: # %bb.0: # %entry
; CHECK-NEXT: vld $vr0, $a1, 0
; CHECK-NEXT: vsubi.hu $vr0, $vr0, 31
; CHECK-NEXT: vst $vr0, $a0, 0
; CHECK-NEXT: ret
entry:
%v0 = load <8 x i16>, ptr %a0
%v1 = sub <8 x i16> %v0, <i16 31, i16 31, i16 31, i16 31, i16 31, i16 31, i16 31, i16 31>
store <8 x i16> %v1, ptr %res
ret void
}
define void @sub_v4i32_31(ptr %res, ptr %a0) nounwind {
; CHECK-LABEL: sub_v4i32_31:
; CHECK: # %bb.0: # %entry
; CHECK-NEXT: vld $vr0, $a1, 0
; CHECK-NEXT: vsubi.wu $vr0, $vr0, 31
; CHECK-NEXT: vst $vr0, $a0, 0
; CHECK-NEXT: ret
entry:
%v0 = load <4 x i32>, ptr %a0
%v1 = sub <4 x i32> %v0, <i32 31, i32 31, i32 31, i32 31>
store <4 x i32> %v1, ptr %res
ret void
}
define void @sub_v2i64_31(ptr %res, ptr %a0) nounwind {
; CHECK-LABEL: sub_v2i64_31:
; CHECK: # %bb.0: # %entry
; CHECK-NEXT: vld $vr0, $a1, 0
; CHECK-NEXT: vsubi.du $vr0, $vr0, 31
; CHECK-NEXT: vst $vr0, $a0, 0
; CHECK-NEXT: ret
entry:
%v0 = load <2 x i64>, ptr %a0
%v1 = sub <2 x i64> %v0, <i64 31, i64 31>
store <2 x i64> %v1, ptr %res
ret void
}