# Benchmark results

这是仓库内 `cmd/benchmark` 标准 workload 的一次可复现实测记录，不是理论峰值。程序使用固定输入规模 `256`、固定迭代次数 `100` 和显式 seed；每个 workload 计为 `25,600` 次输入操作，5 个 workload 合计 `128,000` 次输入操作。

## 环境

- 日期：2026-08-18
- 操作系统：Windows（本地验收机）
- MoonBit：`moon 0.1.20260807` / `moonc v0.10.7+bc794d341`
- 运行目标：native，debug/default build
- 命令：`moon run cmd/benchmark --target native`
- 计时方式：PowerShell `Measure-Command`，包含命令启动和原生程序执行时间，不包含首次安装工具链时间

## 程序输出

| workload | iterations | input | operations | checksum |
|---|---:|---:|---:|---:|
| norm_cdf | 100 | 256 | 25,600 | 25175.72515901282 |
| summary_statistics | 100 | 256 | 25,600 | 111.66753194851682 |
| proportion_test | 100 | 256 | 25,600 | 66.34005485574033 |
| bootstrap_mean | 100 | 256 | 25,600 | 2000 |
| validation_scan | 100 | 256 | 25,600 | 25600 |
| **total** | 500 | — | **128,000** | — |

checksum 用于检查算法输出是否发生意外变化；它不是耗时指标，也不代表统计结果的业务含义。

## 五次端到端实测

| run | elapsed (ms) |
|---:|---:|
| 1 | 354.6626 |
| 2 | 346.1230 |
| 3 | 322.8781 |
| 4 | 280.8822 |
| 5 | 306.6537 |
| **mean** | **322.2399** |
| **min / max** | **280.8822 / 354.6626** |

在这组测量中，命令级平均吞吐约为 `397,220` 输入操作/秒（`128,000 / 0.3222399`）；该数字包含进程启动开销，仅用于同一机器、同一工具链下的回归比较。提交新的基准结果时应保留输入、seed、工具链和计时口径。

## 复核

```text
moon check --deny-warn --target native
moon test --deny-warn --target native
moon run cmd/benchmark --target native
```

CI 会在 Ubuntu、macOS、Windows 上使用最新 stable MoonBit 重新执行全后端检查与测试；本页的 Windows 数据不应被解释为跨操作系统性能结论。
