性能分析
当前 0.7.1 基准的 scaling 共执行 1,476 次校验,其中 1,368 次通过、DzmingLi 失败 108 次。扩展 common-digits 对 19 个操作执行 1,368 次校验并全部通过。
在双方都通过 oracle 的 1,024 位,floating GDA 的 arithmetic-only 中位数为 0.978–16.798 µs/op,DzmingLi 为 12.459–78.978 µs/op;full-path 分别为 7.427–24.133 µs/op 与 152.145–205.549 µs/op。GDA 的 speedup 随操作和 scope 为 3.54–95.44×。
DzmingLi 从 4,096 位开始算术不正确,因此这些点不能解释为 speedup。20,000 位时,已验证的 GDA arithmetic-only 加、减、除、比较分别为 14.810、15.083、60.588、0.130 µs/op;full-path 分别为 154.468、155.582、131.363、139.865 µs/op。
DzmingLi 的 arithmetic-only 比较在大规模输入处仍表现出数据相关短路:4,096、8,192、10,000、16,384 和 20,000 位的中位数依次为 105.918、0.103、675.705、0.101 和 2,203.063 µs/op。部分 fixture 可由符号、指数或有效位数等元数据立即判定,另一些则需要深入比较长系数,因此不能把折线尖峰解释为单一的位数伸缩规律。