本地回测工作台

PC28 回测复盘

将方法版本、样本边界、候选和值和逐期实际结果放在同一份可复核记录中。计算仅在当前浏览器内完成,不连接开奖记录或预测服务,也不会把未提供的数据展示为即时结果。

Evaluation chain

输入截止点 → 候选集合 → 实际和值 → 统一口径评价

回测配置与逐期数据

先固定设定,再生成浏览器内报告。

本地计算 · 不上传
训练区间
测试区间

每行使用竖线分隔:期号|输入截止点|候选和值(/分隔)|实际和值|记录类型

实际和值只接受 0—27;候选数量必须与设定一致。

本地报告已生成。下方结果、分栏统计与逐期审计表均来自本次输入。

用于说明历史样本、预测输出与结果核对关系的数据研究画面
Method / Baseline / Metric

0—27

和值范围是评价对象,不代表各和值具有相同出现概率。基准需要来自明确的训练口径,而不是未经验证的均匀假设。

方法规格先于结果

先写清“评什么”,再判断“表现如何”

目标与评价单位

本页按逐期候选和值集合评价:实际和值进入当期候选集合即记为命中,否则记为未命中。缺少实际和值或字段不完整的记录不会进入有效评价。

覆盖率

覆盖率表示有效评价期数占全部输入期数的比例。它帮助识别报告是否因缺失数据、异常行或未结算记录而只覆盖了部分样本。

集合大小影响

更大的候选集合会改变命中口径。比较方法时,应保持集合大小一致,或将不同大小分别汇报,避免把扩大覆盖范围误读为方法改进。

固定基准

基准候选集应在测试开始前由训练样本或既定规则确定。工具只按您填写的固定集合对照,不从测试结果倒推更有利的基准。

“历史模拟”表示方法在旧数据上的重放;“真实发布”表示当时已经留下输出记录。两者可以使用同一指标,但证据强度不同,因此在结果中分栏呈现。

结果面板

全部测试区间与分段表现

面板不会预置命中数据。提交通过校验的逐期记录后,才会显示本次本地计算结果。

尚未生成回测报告

完成顶部配置并提交逐期记录后,结果将在这里展开。

全部输入

期记录

有效评价

未评估

覆盖率

有效期数 / 全部期数

方法命中率

次命中

固定基准

次命中

记录类型分栏

记录类型 有效期数 方法命中 方法命中率 基准命中率
当前面板提供描述性统计,不自动给出置信区间或显著性结论。样本较少、期次相关性、数据更正和参数反复选择都可能增加不确定性,应结合完整审计记录解读。

逐期审计

每一项结论都回到当时记录

输入截止点用于确认该期输出在何时形成。候选集合、实际和值与评价结论并排显示,便于检查是否存在测试结果进入输入、记录类型混用或事后改写。

审计表等待顶部输入。
期号 输入截止点 记录类型 方法输出 实际和值 评价 基准

当前工具仅接受具有实际和值的完整行。尚未开奖或无法评价的记录应保留在源报告中并标注原因,不应以空值行替代后直接计入命中率分母。

REPORT VERSION / DATA CORRECTION / PARAMETER CHANGE

让下一次复盘能够重现这一次判断

一份可复现报告不只保存最终百分比,还应保存数据版本、方法版本、参数、时间边界和逐期输出。若原始号码、换算结果或期号对应关系发生更正,应建立新报告版本,并保留更正原因与受影响期次。

运行条件

记录使用的数据导出时间、换算规则、时区、输入截止逻辑和脚本版本。相同名称的方法若参数不同,应视为不同版本。

数据更正

不要覆盖旧报告。注明更正前后数值、来源日期以及指标变化,使读者能够区分数据修复与方法性能变化。

参数调整

测试后才决定的窗口、筛选条件或候选集合会引入事后选择。调整后的版本应进入新的样本外区间,而不是回写原测试设定。

边界说明

历史回测描述既定规则在已发生样本中的表现;真实发布记录更接近事前检验,但两者都不能单独证明未来结果或收益。

建议导出或另行保存本次输入文本,并为报告附上唯一版本名。浏览器刷新后,本页不会从服务器恢复配置;这能避免把临时示例误认作平台已保存的正式回测记录。