📐 基准测试方法论与数据规范

测试方法论与数据标准中心

我们为什么坚持拒绝虚构跑分?网络测速为什么不能简单拿单次跑分定优劣?本文档详细公开本站的数据分类、统计口径与质量控制标准。

#01 严格的数据来源分级体系 (Source Types)

为了确保每一项指标来源可查,全站所有数据均被严格打上数据属性标签,绝不混淆:

official_test (本站实测)

本站标准实测

仅由本站自费订阅、在受控网络环境(固定 ISP、专线抓包、多时段连续采样)下完成的标准化测试。目前暂无原始测试凭据前,严格展示为 0 份。

user_submission (用户自测)

用户自测提交

由真实用户自发测试并提交的数据,注明测试地区、ISP 与时段。标注为“未经本站独立复测”,作为分布式网络参考。

public_reference (公开资料)

公开基础资料

整理自各服务商公开的套餐规格、协议支持与节点分布,仅作为档案参考。若未进行跑分,性能指标一律置为 null。

#02 为什么不同用户的测速结果不能直接简单对比?

许多测评网站直接将不同网友的测速截图排在一起,这是极其不科学的。网络节点的传输性能受到以下五重客观物理因素的决定性制约:

  • 1. 本地运营商与接入路由: 不同省份的电信、联通、移动对境外节点的公网 Peer 质量天差地别。广东电信与黑龙江移动测试同一个香港节点,物理链路和延迟完全不同。
  • 2. 本地物理宽带上限 (Baseline): 在 100M 宽带下跑出 95 Mbps 实际上已经达到了 95% 的线速极限;而在 1000M 宽带下跑出 200 Mbps 仅占 20%。脱离签约宽带谈绝对吞吐毫无意义。
  • 3. 测试时间段与晚高峰负载: 下午 14:00 的空闲期与晚上 21:00 的晚高峰,国际出口互联带宽负载差距巨大。单次闲时测速跑满千兆不代表晚高峰不卡顿。
  • 4. 测速目标服务器 (Target Server): 测速客户端选取的目标 CDN 节点、单线程(Single Stream)与多线程(Multi Stream)并发策略,会产生数倍的测速读数差异。

#03 中位数统计原则与样本量门槛

📊 为什么优先采用中位数 (Median)?

算术平均值(Average)极易受到单次测试因本地 WiFi 波动或偶发超时导致的极端异常值(如 2000ms 延迟)拉偏。中位数能更准确地反映节点在 50% 典型使用场景下的真实表现。若样本充足,将进一步引入 P25(前四分之一优良值)与 P75(后四分之一承载值)。

🚦 科学的样本准入门槛

  • • 样本量 < 5: 判定为“样本不足”,不参与任何性能评分。
  • • 样本量 5–9: 标注为“低样本量参考”,仅展示基础分布。
  • • 样本量 ≥ 10: 具备多时段与多 ISP 分布,方可纳入综合参考池。
数据真实性与中立声明

本站所有服务商档案均基于技术参数与公开信息客观整理,拒绝任何虚构数值与跑分造假。实际网络体验受本地网络、接入时段及路由机制影响,建议用户优先按月订阅并自行验证。