data-management
النجوم١٠
التفرعات٤
آخر تحديث١٣ مارس ٢٠٢٦ في ١٣:١٤
彩票数据管理手册,包含数据抓取、增量更新逻辑及多彩种数据预处理规则。
التثبيت
التثبيت باستخدام Codex أو Claude انسخ هذا Prompt والصقه في Codex أو Claude أو مساعد آخر ليراجع صفحة Skill ويثبّتها لك.
SKILL.md
readonlyالقائمة
彩票数据管理手册,包含数据抓取、增量更新逻辑及多彩种数据预处理规则。
التثبيت باستخدام Codex أو Claude انسخ هذا Prompt والصقه في Codex أو Claude أو مساعد آخر ليراجع صفحة Skill ويثبّتها لك.
多模型预测引擎详解,包含统计学、机器学习、深度学习及启发式算法模型 (Models A-J)。
本项目使用的 AI API 配置、技术指标规范及项目架构参考手册。
中国福利彩票与体育彩票官方规则手册,包含购彩、开奖、中奖标准及兑奖信息。
Logic and process for AI-driven lottery analysis and prediction.
استنادا إلى تصنيف SOC المهني
| name | data_management |
| description | 彩票数据管理手册,包含数据抓取、增量更新逻辑及多彩种数据预处理规则。 |
本项目的数据流程分为 数据同步 (Sync) 和 数据处理 (Process) 两个核心环节。本手册详细记录了相关的逻辑与规则。
数据同步主要由 request_data_update.py 负责,采用增量同步与覆盖更新相结合的策略。
为了解决中奖详情(winnerDetails)可能延迟发布的问题,同步逻辑遵循以下规则:
local_latest),抓取所有期号 >= local_latest 的数据。>= 而非 > 是为了确保本地最新的一期能够被重新抓取。如果官方在中奖数据到账后更新了列表,本地记录将被最新的、含完整中奖信息的记录覆盖。drop_duplicates,确保每期仅保留最新抓取到的版本。local_latest 与系统总期数。如果本地已是最新,则跳过抓取。normalize_issue 函数执行)。数据预处理由 request_process_all_data.py 负责,核心目标是将原始 JSON 响应转化为标准化的分析特征。
程序根据官方备注(remark)和奖级 ID(awardEtc)进行智能映射:
福运奖 字段。追加注数 和 追加奖金 字段。直选 / 单选、组选三、组选六 等特定奖项名称。为了保持数据纯净,程序会执行严格的列清理:
unique_tiers 动态生成允许的列名集合。七等奖 或 追加* 相关列)。一等奖 字样列)。注数、奖金 以及(仅限大乐透)追加* 相关后缀的奖项列。预处理阶段会自动计算以下统计指标:
python request_data_update.py。python request_process_all_data.py。上次更新:2026-03-13