预测逻辑记录

详细记录模型口径、权重、复盘与纠偏方法

# 预测逻辑记录

> 项目路径:`F:\opclab\predict`  
> 适用彩种:七星彩、排列五  
> 说明:彩票开奖结果本质上是随机事件,本项目只做历史开奖数据的统计推演、记录、展示与复盘,不承诺命中。

## 1. 数据范围

### 首次初始化

- 第一次运行时分别抓取:
  - 七星彩最近 100 期;
  - 排列五最近 100 期。
- 数据来源使用 `api/api文档.txt` 中提供的接口:
  - 七星彩:`https://cn.apihz.cn/api/caipiao/qixingcai.php`
  - 排列五:`https://cn.apihz.cn/api/caipiao/pailie5.php`
- 最新一期不带 `qh` 参数获取。
- 历史期号通过最新期号向前递减查询,抓满 100 条有效记录。
- 主接口异常时,自动切换到 `docs/API.txt` 中的备用接口。

### 持续更新

- 按开奖节奏定时调用接口获取最新一期。
- 若接口返回期号已存在,则不重复写入。
- 若出现新期号,则保存到本地 JSON 数据库。

## 2. 开奖与预测时间设置

### 排列五

- 预测时间:每天 19:00。
- 开奖数据拉取与复盘时间:每天 21:30。

### 七星彩

- 预测时间:每周二、周五、周日 19:00。
- 开奖数据拉取与复盘时间:每周二、周五、周日 21:30。

> 19:00 做的是下一期预测;21:30 尝试获取最新开奖数据,并对上一期预测做复盘。

## 3. 预测对象

### 七星彩

- 重点预测:前 4 位。
- 原始开奖数据仍完整保存 7 位,便于后续扩展。

### 排列五

- 预测完整 5 位。

## 4. 位置命名

| 数字第N位 | 名称 |
|---|---:|
| 第1位 | 个位 |
| 第2位 | 十位 |
| 第3位 | 百位 |
| 第4位 | 千位 |
| 第5位 | 万位 |
| 第6位 | 十万位 |
| 第7位 | 百万位 |

## 5. 分位统计逻辑

每个位置单独统计,不把号码整体混在一起。

对每一位每个数字计算以下 **13 个维度**的综合评分:

### 5.1 基础频率(已有)

1. **近 100 期出现次数** — 长期位置属性
2. **近 60 期出现次数** — 中期稳定性
3. **近 30 期出现次数** — 短期热度
4. **趋势修正** — 近30对近60的变化方向

### 5.2 号码遗漏(已有)

5. **当前遗漏期数** — 该数字多久没出现。分段评分:
   - 遗漏 0:0.25(刚出过)
   - 遗漏 1-8:0.35→0.70(逐步升温)
   - 遗漏 9-25:0.85(最佳回补区间)
   - 遗漏 26-35:0.75(开始回落)
   - 遗漏 >35:0.55(不盲目追冷)

### 5.3 走势分析(新增)

6. **号码走势** — 该数字在最近15期的出现频率趋势(前一半 vs 后一半),升温加分、降温减分。
7. **大小走势** — 该位置最近15期的大号(5-9)比例趋势,匹配当前趋势加分。
8. **单双走势** — 该位置最近15期的奇数比例趋势。
9. **质合走势** — 该位置最近15期的质数(2,3,5,7)比例趋势。

### 5.4 遗漏分析扩展(新增)

10. **大小遗漏** — 该位置上次出现同大小属性的数字距今多少期。
11. **单双遗漏** — 该位置上次出现同奇偶属性的数字距今多少期。
12. **质合遗漏** — 该位置上次出现同质合属性的数字距今多少期。

### 5.5 整体结构走势(新增)

13. **和值走势** — 最近10期和值前半均值 vs 后半均值,判断上升/下降/平稳。
14. **和值遗漏** — 优先和值区间多久没出现。
15. **连号走势** — 最近20期相邻位置连续数字(如 2-3、5-6)的出现频率趋势。

## 6. 综合评分模型

每个位置的 0—9 都会得到一个综合分。

### 当前评分权重

| 指标 | 权重 | 含义 |
|---|---:|---|
| 近30期频率 | 28% | 近期热度 |
| 近60期频率 | 20% | 中期稳定度 |
| 近100期频率 | 12% | 长期位置属性 |
| 号码遗漏成熟度 | 15% | 长时间未出后的回补参考 |
| 趋势修正 | 4% | 近30相对近60是否升温 |
| 号码走势 | 3% | 该数字出现频率趋势 |
| 大小走势 | 3% | 大小属性趋势匹配 |
| 单双走势 | 3% | 奇偶属性趋势匹配 |
| 质合走势 | 2% | 质合属性趋势匹配 |
| 大小遗漏 | 3% | 大小属性遗漏回补 |
| 单双遗漏 | 3% | 奇偶属性遗漏回补 |
| 质合遗漏 | 2% | 质合属性遗漏回补 |
| 连号走势(结构) | 2% | 连号趋势(结构评分用) |

> 总权重 = 1.0(100%)

## 7. 结构过滤逻辑

分位候选号码生成后,再用整体结构筛选组合。

### 七星彩前4位

- 和值优先区间:14—23;
- 核心和值:16—21;
- 跨度优先:4—8;
- 奇偶优先:2奇2偶,其次 1奇3偶 / 3奇1偶;
- 大小优先:2大2小,其次 1大3小 / 3大1小;
- 质合优先:2质2合,其次 1质3合 / 3质1合;
- 连号加分:存在相邻连续数字 +0.4;
- 和值走势匹配 +0.25;
- 和值遗漏回补 +0.15。

### 排列五

- 和值优先区间:18—31;
- 核心和值:20—26;
- 跨度优先:5—9;
- 奇偶优先:2奇3偶 / 3奇2偶;
- 大小优先:2大3小 / 3大2小;
- 质合优先:2质3合 / 3质2合 / 1质4合;
- 其余同上。

## 8. 输出结果

每次预测输出:

1. 各位置核心候选号码(7号码模式:3个核心 + 2个次级 + 2个防守);
2. 各位置四号码候选(4号码模式:前4名);
3. 推荐组合(7号码12条 + 4号码12条);
4. 每个号码入选理由(含走势和遗漏维度解释);
5. 走势与遗漏分析摘要(各位置大小/单双/质合比例、和值走势、连号走势);
6. 使用的数据期数、最新历史期号、预测目标期号;
7. 结构指标:和值、跨度、奇偶、大小、质合、连号。

## 9. 复盘逻辑

最新开奖出来后,对上一期预测进行复盘:

1. 按位置判断是否命中候选池;
2. 区分命中层级:核心、次级、防守、未命中;
3. 统计本期位置命中率;
4. 四号码独立复盘:判断4号码位置命中率和组合命中;
5. 统计组合是否包含实际号码;
6. 记录未命中的位置与数字;
7. 根据复盘结果生成纠偏建议。

## 10. 纠偏改善逻辑

当前采用保守纠偏,不自动大幅改模型,避免因单期波动过拟合。

纠偏规则:

- 若连续多期某位置核心候选命中率偏低:提示需要降低近30期热度权重;
- 若未命中数字多为长遗漏号:提示适当提高遗漏成熟度权重;
- 若未命中数字多为近期热号:提示适当提高近30期权重;
- 若大小/单双/质合走势持续偏离:提示调整对应走势权重;
- 若组合结构偏离实际开奖:提示调整和值、跨度、奇偶大小过滤区间;
- 所有纠偏先记录在复盘报告中,通过滚动回测确定最优权重,不直接静默改动核心权重。

## 11. 文件保存

- 开奖数据:`data/draws.json`
- 预测记录:`data/predictions.json`
- 复盘记录:`data/reviews.json`
- 模型状态(含各位置动态权重):`data/model_state.json`
- 抓取状态:`data/update_status.json`
- 配置文件:`config.json`
- 逻辑文档:`docs/prediction_logic.md`
- 备用API:`docs/API.txt`