Skip to main content

cumcm-single-question

完成数学建模竞赛指定单问的路线探索、数学建模、真实计算与迭代验证,比较能独立作答的完整路线,默认优选最多三个方案并提出论文图表建议。优先全国大学生数学建模竞赛,其次其他中文赛事,最后美赛;适用于已有题目与预处理结果后的深入求解,不替代全篇论文制作。

الانتقال إلى التثبيت

معلومات المصدر

المستودع
LKQ667/metamath-harness
آخر نشاط في المصدر
١٠ سبتمبر ٢٠٢٦ في ٠٢:٤٩
لغة SKILL.md المكتشفة
الصينية
النجوم
١٥
التفرعات
١

خيارات التثبيت

يُحدَّد Prompt الذي يراجع المصدر أولًا بشكل افتراضي. يمكنك التبديل إلى أمر مباشر أو تنزيل نسخة محلية.

مراجعة ملفات المصدر

اقرأ SKILL.md وأي ملفات مرافقة يعرضها SkillsMP قبل أن تقرر التثبيت.

مستكشف الملفات
7 ملفات

عرض SKILL.md

SKILL.md
تعليمات المصدر · معاينة للقراءة فقط
name
cumcm-single-question
description
完成数学建模竞赛指定单问的路线探索、数学建模、真实计算与迭代验证,比较能独立作答的完整路线,默认优选最多三个方案并提出论文图表建议。优先全国大学生数学建模竞赛,其次其他中文赛事,最后美赛;适用于已有题目与预处理结果后的深入求解,不替代全篇论文制作。
# 国赛单问深研求解 以国赛国家一等奖优秀作品的建模深度和证据完整性为质量目标,不承诺奖项或未经评审的等级。中文赛事优先,美赛按实际题意与交付要求适配,默认中文沟通。本技能只完成指定一问及必要前置衔接,不自动扩展到全题、整篇排版或投稿。 ## 执行原则 - 默认完成真实求解、验证与交付;用户要求“先探索、不要计算、只推荐路线”时执行下述初探模式,不擅自升级计算。 - 不向用户提问。优先从材料确定答案;可合理推定的分歧记录假设并用情景分析覆盖。关键原文、数据或运行能力确实缺失时,交付已完成部分和明确缺口,不编造数据、结果或完成状态。 - 以机制、约束和数据决定方法,复杂模型与算法拼接本身不构成创新。优先可解释、可复现且回答题目的改进。 - 全程区分原文事实、文献结论、自建假设、推导结论、计算结果和待验证猜想。 - 只写当前项目中本问产物,保护原始数据和已有结果。已有全流程项目沿用目录、结果源及门禁;独立使用不初始化 math-paper-cn 全篇门禁、不修改其阶段状态。 ## 0. 按当前请求确定深度 - **初探**:识别“初次探索、初步探索、初步分析、探索、先探索、探索一下、仅仅分析、仅分析、只分析、先分析思路、思路分析、梳理思路、只要思路、先给思路、方案探讨、路线比较、初步推荐、先推荐方案、暂不求解、先不计算、不要深度计算、先不跑代码、先不做仿真”等表达及近义说法;当其表示本轮只讨论题意、路线或可行性时,阅读题目、数据概况、相关代码/结果与必要文献,判断完整路线及取舍,不运行仿真、训练、优化或性能测试。未要求落盘则直接回复;不生成虚假的结果文件。排序称“优先尝试顺序”,只依据适配度与实施条件。创新称“拟验证的改进”,不声称已取得增益。 - **求解**:默认模式,按第 1–6 步执行实际计算。候选资格在跑模型之前筛查,性能排名在同口径结果验证之后确定。 - **已有方案深化**:用户已选路线时沿该路线改进和验证,不重新凑三选一。只有证据表明它不可行或存在实质更优替代时,说明原因再提供必要替代。 关键词按语境识别,不做机械匹配:“探索/分析问题三”且未要求执行计算时默认初探;“探索参数空间并运行优化”“分析后直接计算求解”“不要只分析,运行代码”等明确执行请求走求解模式。“分析”一词单独出现在“灵敏度分析、误差分析、结果分析”等任务名中不自动切换初探。用户明确限定“先不计算/本轮仅分析”时保持初探;后续要求开始计算再切换求解。 以用户最新要求确定模式;既有结果可供参考,但须标注来自哪次运行以及是否核验,不能当成本轮新计算。初探不强制写求解产物,求解不能以初探计划冒充完成。 ## 1. 读取题目与预处理结果 定位指定问的原文、附件说明、相关前问输出及真实依赖链、数据预处理报告、数据字典和处理后数据。未指定问号时仅在当前上下文唯一指向一问时采用它,否则记录范围不明并完成可确定的材料审计,不擅自求全题。 将本问压成一句可验收目标,再列出 4–6 步“输入—依据—输出”主链。记录目标量、决策量、外生量、约束、评价指标、单位、时间/空间尺度和需要交付的数值或决策。 求解模式读取实际数据核对样本数、主键、连接关系、缺失、异常、单位变换、插补和归一化规则;不能仅相信报告。检查预处理是否泄漏未来或测试信息、删掉极端但真实样本、破坏守恒或改变口径。必要修正在本问派生数据中完成,保留变换和来源。依赖前问估计量时传播其不确定性;缺失时不得当作已知真值。 ## 2. 文献与优秀论文启发 读取项目文献目录和已有笔记,围绕会影响本问路线选择或论证的机制、约束、算法局限与验证方法检索权威资料。用户禁止联网或明确限定隔离测试时不联网,按允许材料给出有边界的判断;不能把检索步骤扩展成超出当前请求的全面调研。优先官方题目说明、原始研究论文、标准发布方、权威机构数据和算法官方文档。实际打开来源核对适用条件,记录标题、作者/机构、年份、DOI/URL、页码或章节及其改变的建模决策。无法联网或无法获得全文时如实限制证据等级,不能把摘要或搜索片段当完整论证。 本机参考入口及使用边界见 [references/source-routing.md](references/source-routing.md)。按主题与机制相关性选择优秀论文,重点学习“问题转译—模型推导—求解—检验—解释”的证据链,不复制文字、数据或所谓创新。年题相同必须核对题目内容,不能仅凭 A/B/C 文件名认定同题。 内部执行三类质疑:清零核对已知与未知;追问假设为什么必要、替代模型为什么不够;用极限输入和反例攻击成熟方案。将答案落为证据、实验或待检假设,不调用交互式提问流程。 建立创新证据表:已有做法 → 本题实际缺口 → 最小必要改动 → 预期机制 → 可证伪实验 → 真实增益与代价 → 检索覆盖和结论边界。优先机制修正、约束刻画、异质性、不确定性传播、可辨识性或求解结构利用。未查到相同方案只能写“在已检索资料中未见”,不得宣称首创。 ## 3. 建模与实验设计 先读取 [references/candidate-selection.md](references/candidate-selection.md),把各候选放在同一题意、目标、约束、输入条件和交付精度下比较。内部可以发散,最终默认优选最多三个能够独立作答、且有实质取舍的完整路线。基线、组件、消融、实现变体、验证与拓展单独归类,不为它们自动预留推荐名额。 用户要求三个时,先认真寻找第三条独立路线;仍不足则只推荐合格的一或两条,并简述不足原因。若只能在改变题意、拆分组件或重复包装后凑足三条,就停止凑数。没有合格路线时明确阻碍,不列空名次。 在求解前确定主指标、可行性容差、验证划分、比较预算及停止规则。可信简单基线用于量化改进,但只有它本身能独立作答且有实际选择价值时才进入推荐。融合路线需要完整的输入—模型—求解—输出链,并说明为何不是已有路线的一个可选增强。 为候选写清符号与单位、假设依据、核心关系推导、目标或估计准则、约束/边界/初值、参数来源和识别方法、求解步骤、适用范围及可失败条件。引用定理注明条件与用途。解释关键公式为什么对应题目要求;不以套公式替代推导。 求解模式进入计算前读取 [references/solve-and-verify.md](references/solve-and-verify.md),按预测、优化、机理仿真或评价任务选择验证方式。 ## 4. 真实计算与迭代优化(仅求解模式) 用当前可用环境执行本问代码,保存命令、版本、输入指纹、参数、随机种子、耗时、退出状态、原始指标与结果文件。先跑基线和最小可行规模验证,再在同口径下计算候选;不能用估计值、示例值或伪造日志替代运行。 根据残差、约束违反、误差分布或搜索停滞定位瓶颈,逐次改变有依据的因素。按问题结构尝试参数优化、初始化、邻域/求解器替换、分解、重启或候选组件重组;融合必须比较单组件与融合版本。保留失败、退化和负结果,避免只报告最好的一次。 每轮记录“假设—改动—结果—保留/淘汰原因”。达到预定预算、目标精度或连续三轮有效改进不足停止;预算耗尽报告剩余 gap 或验证缺口。反复同因报错且无新修复依据时停止重试并记录限制,不无限搜索。资源预算按数据规模及可用环境自定并记录,不擅自购买算力。 ## 4.5 内置逻辑对抗复核 首次真实计算与验证结束后、推荐排序和交付定稿前,执行 [references/logic-review.md](references/logic-review.md)。从题目原文重新审视任务理解、方向/界、重复计量、外推、遗漏变量和跨问一致性,复用有运行依据的既有检查,以原文、代码行及真实数值裁定;不把求解器成功当作语义正确。 这是本技能内部步骤,默认随求解执行,不加载、调用或跳转外部评审技能,也不依赖外部后端开关、脚本或额外模型调用。初探仅做与现有材料相称的静态复核,不启动计算或求解门禁。复核最多首次一次加两次修复后复核;预算、轮次与失败记录跨局部返回持续累计,不递归重启技能。未解决的致命错误或无法核验的裁定以受阻状态交付证据和缺口,不无限回炉,不宣称求解通过。 ## 5. 推荐完整路线,让用户能做选择 先通过候选独立性检查,再排序:求解模式以可行性和验证可信度为前提,按题目主指标、稳健性、可解释性、复杂度和计算代价比较;初探只按已知适配性与实现条件给出优先尝试顺序。未实测成本、精度或创新增益不能写成确定优势。多目标说明权衡,不暗设偏好权重制造唯一赢家。 开头直接给出首选及决定性理由。每条推荐依次回答: 1. **怎样独立完成本问**:用几句通俗话串起输入、核心建模思想、求解与最终输出。标题说清核心方法,不堆“算法 A+算法 B+算法 C”。 2. **为什么值得选**:相对另一条路线换来了什么,又放弃什么。不能只写“先进、稳妥、创新强”。 3. **本题可改进之处**:明确拟改的机制或求解结构,以及验证方法;标准方法就说明是标准方法,不要求每条都挂创新标签。实测后区分有效、无增益和未验证。 4. **什么条件下改选它**:以数据条件、误差要求、成本或实现难点表达;只有证据支持时给具体数值阈值。 初探每条一段说明加必要的取舍即可,公式仅保留帮助理解主问题或区分路线的关键式。求解模式补上可比指标表、真实数值、运行依据与必要推导。比较表优先写“核心差异—选择收益—代价—证据状态”,不要把“主线/核验/拓展”作为三条推荐的用途列。 共同的几何核对、误差认证、独立复核、消融和灵敏度分析统一放在推荐之后,简要说明它们如何验证所选路线,不作为同级方案。若某方法兼作基线与候选,说明它无需首选路线结果也能独立给出答案。 最终应帮助用户选择一条主路线;不得先写三个平行候选,结尾却默认建议三者分别充当主线、核验、拓展。确需串联时将其整理为一条完整路线再与其他路线比较。条件接近时给条件性推荐;失败/未验证的实验记录保留在依据中,不占求解模式的“已验证推荐”名次。 ## 6. 本文图表建议与交付 读取 [references/figure-standard.md](references/figure-standard.md),求解模式基于真实结果、初探模式基于拟验证论断建议中文顶级科研论文质量的图表,以证据密度、准确性和印刷可读性验收,不把“一区/top1”当可自动认证标签。 默认交付图表建议及其所需数据,不因本技能自动启动全篇制图。求解诊断图可按需要生成;用户另要求成图时执行正式导出与视觉检查。 求解模式沿用项目现有布局;独立运行默认在 `Qn/` 内保留(初探不强制生成): - `model.md`:题意、数据审计、推导、候选与创新证据。 - `solve.py` 或实际求解入口及所需模块、配置:可复现计算。 - `runs/`:实验记录、必要原始输出与验证证据。 - `results/final_results.json`:最终数值唯一来源,包含候选状态、指标单位、验证范围、输入/运行引用与推荐理由;若项目已有统一结果源则复用它,不另造冲突副本。 - `result.md`:本问答案、合格路线排序、证据状态与通俗改进说明、运行命令与局限。 - `figure_plan.md`:按入文优先级排列的图表及证据映射。 - `COMP_REVIEW.md`、`COMP_REVIEW_VERDICT.json`:本问内置逻辑复核的证据、问题状态、修复轮次及门禁裁定,格式和终止规则见第 4.5 步;已有统一审计产物时将同等字段并入原产物并记录位置,避免重复结果源。 交付门禁以第 4.5 步的当前有效裁定为准:受阻路线不得进入“已验证推荐”,其失败证据仍须交付。最终复跑若改变关键结果或暴露新问题,原裁定失效,仅在剩余复核预算内检查受影响项;预算耗尽则标为受阻,不重置循环。 交付前核对题目要求覆盖、数学闭合、数据口径、真实运行、公平比较、稳健性/消融、创新边界、数值来源及图表数据可用性。重跑推荐方案的可行规模或完整入口并核对关键结果;无法完整重跑时说明实际验证范围。未通过项不得写成已通过。最终给出文件链接、合格路线及关键数值,不只交付计划。初探则检查题意一致、候选独立、差异真实、取舍清楚和证据措辞,明确尚未计算,不执行求解完成门禁。
عرض على GitHub