- Quantity measured
- A_sample = N_OK / (N_OK + N_FAIL)(分母含哪些类由计数口径决定,见 AVAIL-04);A_time = 1 − Σ_e d_e / (T − T_excluded);coverage = 有效观测槽 / 计划槽;短故障检出概率 P_detect(d) = 1 − (1 − min(1, d/Δ))^m,m 为相位去相关的探针数。
- Fixed parameters
- Δ 分档:A=60 s、B=300 s、C=900 s、D=每日 4 次固定 UTC 时刻;确认探测延迟 5 s;事件确认阈 2 槽或 2 个不同 ASN;恢复确认阈 2 槽;覆盖率闸门 95%;窗口 T=30 天(UTC 对齐,预注册)。
- Sample size
- A 档 Δ=60 s、T=30 天 → 每探针每端点 43,200 槽,6 探针合计 259,200;B 档 8,640/探针;C 档 2,880/探针;D 档 120/探针。全窗全平台样本量级 10^6–10^7 行。检出功效(设计推导,非实测;团队须按自身 m、Δ 重算并随方法页发布曲线):m=6、Δ=60 s 时,d=10 s → 0.67,d=20 s → 0.91,d=30 s → 0.98;短于 Δ 的抖动系统性不可见。
- Control
- canary 与第三方对照端点同槽并行;同一探针对多平台的并行观测用于共因判定;确认探测与主样本在数据表中物理分列,杜绝混入。
- Statistical treatment
- A_sample 的区间见 AVAIL-08(移动块自助法);事件持续时间按 ±Δ 均匀界报告,禁止把 d 报到比 Δ 更细的精度;事件计数用泊松精确区间;coverage 与删失比例作为强制随附列。
- Reproducibility check
- 分类与事件重建实现为对(原始归档, signatures.json, 参数文件)的纯函数;由未参与采集的成员在另一台机器上重跑,产出的 events.csv 必须与发布版逐行一致。发布脚本 Git 提交哈希与运行日志一并公布,README 给出各派生表的预期 SHA-256。
- Known pitfalls
- 闭环调度是最常见的隐性错误;用系统 cron 的整分对齐会让所有探针同相位、同时错过短故障;把确认探测计入分子会系统性抬高可用性;把单探针单样本的抖动直接当成平台故障。
- Risk
- 确认探测对每个非 OK 样本仅一次,不得在同槽内对同一端点连发;出现 429 立即停止该(探针, 平台)全部探测并退避,不得换 IP、不得降低 UA 可识别性继续。