data-management
スター10
フォーク4
更新日2026年3月13日 13:14
彩票数据管理手册,包含数据抓取、增量更新逻辑及多彩种数据预处理规则。
インストール
Codex または Claude でインストール この Prompt をコピーして Codex、Claude、または他のアシスタントに貼り付けると、Skill ページを確認してインストールできます。
SKILL.md
readonlyメニュー
彩票数据管理手册,包含数据抓取、增量更新逻辑及多彩种数据预处理规则。
Codex または Claude でインストール この Prompt をコピーして Codex、Claude、または他のアシスタントに貼り付けると、Skill ページを確認してインストールできます。
多模型预测引擎详解,包含统计学、机器学习、深度学习及启发式算法模型 (Models A-J)。
本项目使用的 AI API 配置、技术指标规范及项目架构参考手册。
中国福利彩票与体育彩票官方规则手册,包含购彩、开奖、中奖标准及兑奖信息。
Logic and process for AI-driven lottery analysis and prediction.
SOC 職業分類に基づく
| name | data_management |
| description | 彩票数据管理手册,包含数据抓取、增量更新逻辑及多彩种数据预处理规则。 |
本项目的数据流程分为 数据同步 (Sync) 和 数据处理 (Process) 两个核心环节。本手册详细记录了相关的逻辑与规则。
数据同步主要由 request_data_update.py 负责,采用增量同步与覆盖更新相结合的策略。
为了解决中奖详情(winnerDetails)可能延迟发布的问题,同步逻辑遵循以下规则:
local_latest),抓取所有期号 >= local_latest 的数据。>= 而非 > 是为了确保本地最新的一期能够被重新抓取。如果官方在中奖数据到账后更新了列表,本地记录将被最新的、含完整中奖信息的记录覆盖。drop_duplicates,确保每期仅保留最新抓取到的版本。local_latest 与系统总期数。如果本地已是最新,则跳过抓取。normalize_issue 函数执行)。数据预处理由 request_process_all_data.py 负责,核心目标是将原始 JSON 响应转化为标准化的分析特征。
程序根据官方备注(remark)和奖级 ID(awardEtc)进行智能映射:
福运奖 字段。追加注数 和 追加奖金 字段。直选 / 单选、组选三、组选六 等特定奖项名称。为了保持数据纯净,程序会执行严格的列清理:
unique_tiers 动态生成允许的列名集合。七等奖 或 追加* 相关列)。一等奖 字样列)。注数、奖金 以及(仅限大乐透)追加* 相关后缀的奖项列。预处理阶段会自动计算以下统计指标:
python request_data_update.py。python request_process_all_data.py。上次更新:2026-03-13