Skip to main content

cumcm-single-question

完成数学建模竞赛指定单问的路线探索、数学建模、真实计算与迭代验证,比较能独立作答的完整路线,默认优选最多三个方案并提出论文图表建议。优先全国大学生数学建模竞赛,其次其他中文赛事,最后美赛;适用于已有题目与预处理结果后的深入求解,不替代全篇论文制作。

설치로 이동

소스 정보

저장소
LKQ667/metamath-harness
최근 소스 활동
2026년 9월 10일 02:49
감지된 SKILL.md 언어
중국어
스타
15
포크
1

설치 방법

기본적으로 소스를 먼저 확인하는 Prompt가 선택됩니다. 직접 명령으로 전환하거나 로컬 사본을 다운로드할 수도 있습니다.

소스 파일 검토

설치 여부를 결정하기 전에 SKILL.md와 SkillsMP에 표시된 보조 파일을 읽어 보세요.

파일 탐색기
7 개 파일

SKILL.md 표시 중

SKILL.md
소스 지침 · 읽기 전용 미리보기
name
cumcm-single-question
description
完成数学建模竞赛指定单问的路线探索、数学建模、真实计算与迭代验证,比较能独立作答的完整路线,默认优选最多三个方案并提出论文图表建议。优先全国大学生数学建模竞赛,其次其他中文赛事,最后美赛;适用于已有题目与预处理结果后的深入求解,不替代全篇论文制作。
# 国赛单问深研求解 以国赛国家一等奖优秀作品的建模深度和证据完整性为质量目标,不承诺奖项或未经评审的等级。中文赛事优先,美赛按实际题意与交付要求适配,默认中文沟通。本技能只完成指定一问及必要前置衔接,不自动扩展到全题、整篇排版或投稿。 ## 执行原则 - 默认完成真实求解、验证与交付;用户要求“先探索、不要计算、只推荐路线”时执行下述初探模式,不擅自升级计算。 - 不向用户提问。优先从材料确定答案;可合理推定的分歧记录假设并用情景分析覆盖。关键原文、数据或运行能力确实缺失时,交付已完成部分和明确缺口,不编造数据、结果或完成状态。 - 以机制、约束和数据决定方法,复杂模型与算法拼接本身不构成创新。优先可解释、可复现且回答题目的改进。 - 全程区分原文事实、文献结论、自建假设、推导结论、计算结果和待验证猜想。 - 只写当前项目中本问产物,保护原始数据和已有结果。已有全流程项目沿用目录、结果源及门禁;独立使用不初始化 math-paper-cn 全篇门禁、不修改其阶段状态。 ## 0. 按当前请求确定深度 - **初探**:识别“初次探索、初步探索、初步分析、探索、先探索、探索一下、仅仅分析、仅分析、只分析、先分析思路、思路分析、梳理思路、只要思路、先给思路、方案探讨、路线比较、初步推荐、先推荐方案、暂不求解、先不计算、不要深度计算、先不跑代码、先不做仿真”等表达及近义说法;当其表示本轮只讨论题意、路线或可行性时,阅读题目、数据概况、相关代码/结果与必要文献,判断完整路线及取舍,不运行仿真、训练、优化或性能测试。未要求落盘则直接回复;不生成虚假的结果文件。排序称“优先尝试顺序”,只依据适配度与实施条件。创新称“拟验证的改进”,不声称已取得增益。 - **求解**:默认模式,按第 1–6 步执行实际计算。候选资格在跑模型之前筛查,性能排名在同口径结果验证之后确定。 - **已有方案深化**:用户已选路线时沿该路线改进和验证,不重新凑三选一。只有证据表明它不可行或存在实质更优替代时,说明原因再提供必要替代。 关键词按语境识别,不做机械匹配:“探索/分析问题三”且未要求执行计算时默认初探;“探索参数空间并运行优化”“分析后直接计算求解”“不要只分析,运行代码”等明确执行请求走求解模式。“分析”一词单独出现在“灵敏度分析、误差分析、结果分析”等任务名中不自动切换初探。用户明确限定“先不计算/本轮仅分析”时保持初探;后续要求开始计算再切换求解。 以用户最新要求确定模式;既有结果可供参考,但须标注来自哪次运行以及是否核验,不能当成本轮新计算。初探不强制写求解产物,求解不能以初探计划冒充完成。 ## 1. 读取题目与预处理结果 定位指定问的原文、附件说明、相关前问输出及真实依赖链、数据预处理报告、数据字典和处理后数据。未指定问号时仅在当前上下文唯一指向一问时采用它,否则记录范围不明并完成可确定的材料审计,不擅自求全题。 将本问压成一句可验收目标,再列出 4–6 步“输入—依据—输出”主链。记录目标量、决策量、外生量、约束、评价指标、单位、时间/空间尺度和需要交付的数值或决策。 求解模式读取实际数据核对样本数、主键、连接关系、缺失、异常、单位变换、插补和归一化规则;不能仅相信报告。检查预处理是否泄漏未来或测试信息、删掉极端但真实样本、破坏守恒或改变口径。必要修正在本问派生数据中完成,保留变换和来源。依赖前问估计量时传播其不确定性;缺失时不得当作已知真值。 ## 2. 文献与优秀论文启发 读取项目文献目录和已有笔记,围绕会影响本问路线选择或论证的机制、约束、算法局限与验证方法检索权威资料。用户禁止联网或明确限定隔离测试时不联网,按允许材料给出有边界的判断;不能把检索步骤扩展成超出当前请求的全面调研。优先官方题目说明、原始研究论文、标准发布方、权威机构数据和算法官方文档。实际打开来源核对适用条件,记录标题、作者/机构、年份、DOI/URL、页码或章节及其改变的建模决策。无法联网或无法获得全文时如实限制证据等级,不能把摘要或搜索片段当完整论证。 本机参考入口及使用边界见 [references/source-routing.md](references/source-routing.md)。按主题与机制相关性选择优秀论文,重点学习“问题转译—模型推导—求解—检验—解释”的证据链,不复制文字、数据或所谓创新。年题相同必须核对题目内容,不能仅凭 A/B/C 文件名认定同题。 内部执行三类质疑:清零核对已知与未知;追问假设为什么必要、替代模型为什么不够;用极限输入和反例攻击成熟方案。将答案落为证据、实验或待检假设,不调用交互式提问流程。 建立创新证据表:已有做法 → 本题实际缺口 → 最小必要改动 → 预期机制 → 可证伪实验 → 真实增益与代价 → 检索覆盖和结论边界。优先机制修正、约束刻画、异质性、不确定性传播、可辨识性或求解结构利用。未查到相同方案只能写“在已检索资料中未见”,不得宣称首创。 ## 3. 建模与实验设计 先读取 [references/candidate-selection.md](references/candidate-selection.md),把各候选放在同一题意、目标、约束、输入条件和交付精度下比较。内部可以发散,最终默认优选最多三个能够独立作答、且有实质取舍的完整路线。基线、组件、消融、实现变体、验证与拓展单独归类,不为它们自动预留推荐名额。 用户要求三个时,先认真寻找第三条独立路线;仍不足则只推荐合格的一或两条,并简述不足原因。若只能在改变题意、拆分组件或重复包装后凑足三条,就停止凑数。没有合格路线时明确阻碍,不列空名次。 在求解前确定主指标、可行性容差、验证划分、比较预算及停止规则。可信简单基线用于量化改进,但只有它本身能独立作答且有实际选择价值时才进入推荐。融合路线需要完整的输入—模型—求解—输出链,并说明为何不是已有路线的一个可选增强。 为候选写清符号与单位、假设依据、核心关系推导、目标或估计准则、约束/边界/初值、参数来源和识别方法、求解步骤、适用范围及可失败条件。引用定理注明条件与用途。解释关键公式为什么对应题目要求;不以套公式替代推导。 求解模式进入计算前读取 [references/solve-and-verify.md](references/solve-and-verify.md),按预测、优化、机理仿真或评价任务选择验证方式。 ## 4. 真实计算与迭代优化(仅求解模式) 用当前可用环境执行本问代码,保存命令、版本、输入指纹、参数、随机种子、耗时、退出状态、原始指标与结果文件。先跑基线和最小可行规模验证,再在同口径下计算候选;不能用估计值、示例值或伪造日志替代运行。 根据残差、约束违反、误差分布或搜索停滞定位瓶颈,逐次改变有依据的因素。按问题结构尝试参数优化、初始化、邻域/求解器替换、分解、重启或候选组件重组;融合必须比较单组件与融合版本。保留失败、退化和负结果,避免只报告最好的一次。 每轮记录“假设—改动—结果—保留/淘汰原因”。达到预定预算、目标精度或连续三轮有效改进不足停止;预算耗尽报告剩余 gap 或验证缺口。反复同因报错且无新修复依据时停止重试并记录限制,不无限搜索。资源预算按数据规模及可用环境自定并记录,不擅自购买算力。 ## 4.5 内置逻辑对抗复核 首次真实计算与验证结束后、推荐排序和交付定稿前,执行 [references/logic-review.md](references/logic-review.md)。从题目原文重新审视任务理解、方向/界、重复计量、外推、遗漏变量和跨问一致性,复用有运行依据的既有检查,以原文、代码行及真实数值裁定;不把求解器成功当作语义正确。 这是本技能内部步骤,默认随求解执行,不加载、调用或跳转外部评审技能,也不依赖外部后端开关、脚本或额外模型调用。初探仅做与现有材料相称的静态复核,不启动计算或求解门禁。复核最多首次一次加两次修复后复核;预算、轮次与失败记录跨局部返回持续累计,不递归重启技能。未解决的致命错误或无法核验的裁定以受阻状态交付证据和缺口,不无限回炉,不宣称求解通过。 ## 5. 推荐完整路线,让用户能做选择 先通过候选独立性检查,再排序:求解模式以可行性和验证可信度为前提,按题目主指标、稳健性、可解释性、复杂度和计算代价比较;初探只按已知适配性与实现条件给出优先尝试顺序。未实测成本、精度或创新增益不能写成确定优势。多目标说明权衡,不暗设偏好权重制造唯一赢家。 开头直接给出首选及决定性理由。每条推荐依次回答: 1. **怎样独立完成本问**:用几句通俗话串起输入、核心建模思想、求解与最终输出。标题说清核心方法,不堆“算法 A+算法 B+算法 C”。 2. **为什么值得选**:相对另一条路线换来了什么,又放弃什么。不能只写“先进、稳妥、创新强”。 3. **本题可改进之处**:明确拟改的机制或求解结构,以及验证方法;标准方法就说明是标准方法,不要求每条都挂创新标签。实测后区分有效、无增益和未验证。 4. **什么条件下改选它**:以数据条件、误差要求、成本或实现难点表达;只有证据支持时给具体数值阈值。 初探每条一段说明加必要的取舍即可,公式仅保留帮助理解主问题或区分路线的关键式。求解模式补上可比指标表、真实数值、运行依据与必要推导。比较表优先写“核心差异—选择收益—代价—证据状态”,不要把“主线/核验/拓展”作为三条推荐的用途列。 共同的几何核对、误差认证、独立复核、消融和灵敏度分析统一放在推荐之后,简要说明它们如何验证所选路线,不作为同级方案。若某方法兼作基线与候选,说明它无需首选路线结果也能独立给出答案。 最终应帮助用户选择一条主路线;不得先写三个平行候选,结尾却默认建议三者分别充当主线、核验、拓展。确需串联时将其整理为一条完整路线再与其他路线比较。条件接近时给条件性推荐;失败/未验证的实验记录保留在依据中,不占求解模式的“已验证推荐”名次。 ## 6. 本文图表建议与交付 读取 [references/figure-standard.md](references/figure-standard.md),求解模式基于真实结果、初探模式基于拟验证论断建议中文顶级科研论文质量的图表,以证据密度、准确性和印刷可读性验收,不把“一区/top1”当可自动认证标签。 默认交付图表建议及其所需数据,不因本技能自动启动全篇制图。求解诊断图可按需要生成;用户另要求成图时执行正式导出与视觉检查。 求解模式沿用项目现有布局;独立运行默认在 `Qn/` 内保留(初探不强制生成): - `model.md`:题意、数据审计、推导、候选与创新证据。 - `solve.py` 或实际求解入口及所需模块、配置:可复现计算。 - `runs/`:实验记录、必要原始输出与验证证据。 - `results/final_results.json`:最终数值唯一来源,包含候选状态、指标单位、验证范围、输入/运行引用与推荐理由;若项目已有统一结果源则复用它,不另造冲突副本。 - `result.md`:本问答案、合格路线排序、证据状态与通俗改进说明、运行命令与局限。 - `figure_plan.md`:按入文优先级排列的图表及证据映射。 - `COMP_REVIEW.md`、`COMP_REVIEW_VERDICT.json`:本问内置逻辑复核的证据、问题状态、修复轮次及门禁裁定,格式和终止规则见第 4.5 步;已有统一审计产物时将同等字段并入原产物并记录位置,避免重复结果源。 交付门禁以第 4.5 步的当前有效裁定为准:受阻路线不得进入“已验证推荐”,其失败证据仍须交付。最终复跑若改变关键结果或暴露新问题,原裁定失效,仅在剩余复核预算内检查受影响项;预算耗尽则标为受阻,不重置循环。 交付前核对题目要求覆盖、数学闭合、数据口径、真实运行、公平比较、稳健性/消融、创新边界、数值来源及图表数据可用性。重跑推荐方案的可行规模或完整入口并核对关键结果;无法完整重跑时说明实际验证范围。未通过项不得写成已通过。最终给出文件链接、合格路线及关键数值,不只交付计划。初探则检查题意一致、候选独立、差异真实、取舍清楚和证据措辞,明确尚未计算,不执行求解完成门禁。
GitHub에서 보기