样本量与区间
较短区间可能被少量连续结果明显影响。比较不同方法时,应尽量保持期次范围、缺失处理和有效分母一致;若区间不同,应把差异直接写入结论,而不是只排列百分比。
Backtest / Review
将历史模拟与发布后预测分开记录,核对方法版本、样本区间、原始预测和实际结果。工作台不会自动获取开奖记录,也不会预置虚构成绩;输入保留在当前浏览器会话中,刷新页面后不会保存。
两种记录使用独立计数,不合并为单一命中率。
方法版本和样本边界应先于成绩存在。参数修改、数据补齐或评价区间变化后,应建立新的快照,而不是覆盖旧版本。
当前轨道:历史回测。请描述训练数据与评估数据如何切分,以及逐期运行时可使用的数据边界。
当前轨道:发布后复盘。请记录预测发布时的方法版本与适用范围,不以事后调整替换原始内容。
和值候选、大小单双与极值分类的覆盖范围不同,不能只用“命中次数”横向比较。本工具按任务分别统计,仅将状态为“已核对”且实际和值有效的记录纳入分母。
明细按录入顺序保存预测原文。评价结论由任务定义与实际和值确定,待核对和撤回状态不会被隐藏。
尚未录入复盘记录
使用上方表单加入历史模拟或发布后预测,本页不会自动填充示例成绩。
| 轨道 | 适用期次 | 生成时间 | 任务 | 原始预测 | 实际和值 | 评价结论 | 操作 |
|---|---|---|---|---|---|---|---|
回测适合检验规则在指定历史样本中的表现,但结果会受到样本量、区间选择、参数搜索和方法版本变化影响。历史区间内的表现不能替代未来有效性的证据,也不应被表述为下一期必然结果。
较短区间可能被少量连续结果明显影响。比较不同方法时,应尽量保持期次范围、缺失处理和有效分母一致;若区间不同,应把差异直接写入结论,而不是只排列百分比。
调整候选数量、阈值或窗口后,评价对象已经改变。新参数应生成新版本,并保留旧版记录。发布后复盘尤其需要保留当时的预测文本和生成时间,避免使用实际结果反向修订。
本工具按和值0—13为小、14—27为大,奇数为单、偶数为双;0—5标记为极小,22—27标记为极大,其他和值归为非极值。不同规则来源应另建方法版本。
若需要补充实际结果,可先前往开奖记录核对期次;若要回看计划生成时的说明,则从计划参考查找对应内容。两者都应与本页的适用期次和发布时间保持一致。