Missed Optimization: failure to reduce chained sign flips to XOR of sign checks.
- Dominant language
- LLVM
- Stars
- 40.5k
- Forks
- 18.7k
- PR merge metrics
- PR metrics pending
Description
```llvm
define i1 @src(double %arg2, ptr %arg0, ptr %arg1) {
%v0 = fcmp ult double %arg2, 0.000000e+00
%v1 = load double, ptr %arg1, align 8
%v2 = fcmp ult double %v1, 0.000000e+00
%v3 = select i1 %v2, double -1.000000e+00, double 1.000000e+00
%v4 = fneg double %v3
%v5 = select i1 %v0, double %v4, double %v3
%v6 = load double, ptr %arg0, align 8
%v7 = fcmp ult double %v6, 0.000000e+00
%v8 = fneg double %v5
%v9 = select i1 %v7, double %v8, double %v5
%v10 = fcmp ult double %v9, 0.000000e+00
ret i1 %v10
}
define i1 @tgt(double %arg2, ptr %arg0, ptr %arg1) {
%v1 = load double, ptr %arg1, align 8
%v6 = load double, ptr %arg0, align 8
%v0 = fcmp ult double %arg2, 0.000000e+00
%v2 = fcmp ult double %v1, 0.000000e+00
%v7 = fcmp ult double %v6, 0.000000e+00
%v3 = xor i1 %v0, %v2
%v8 = xor i1 %v3, %v7
ret i1 %v8
}
```
alive2: https://alive2.llvm.org/ce/z/rUNYxC
godbolt: https://godbolt.org/z/vWv14s47M
Pattern found in: https://github.com/dtcxzyw/llvm-opt-benchmark/blob/main/bench/openblas/optimized/dlasd4.ll
Contributor guide
Assessment
This issue has not been assessed yet.