Skip to main content

chatgpt-frontier-pilot

GPT-5.6 Sol high 的最高強度稽核與優化工作流,包含 trace-first diagnosis、對抗式檢查與兩種獨立驗證。使用者提到 ChatGPT frontier pilot、GPT-5.6 Sol high、最強稽核或全面優化時使用。例行程式修改或快速小改不要使用。

跳到安装

来源信息

仓库
zeuikli/openai-codex-workspace
最近来源活动
2026年7月22日 02:53
检测到的 SKILL.md 语言
中文
星标
2
分支
0

安装方式

默认使用会先检查来源的 Prompt;你也可以切换为直接命令,或下载本地副本。

检查来源文件

决定是否安装前,请先阅读 SKILL.md,以及 SkillsMP 当前展示的配套文件。

文件资源管理器
2 个文件

正在显示 SKILL.md

SKILL.md
来源说明 · 只读预览
name
chatgpt-frontier-pilot
description
GPT-5.6 Sol high 的最高強度稽核與優化工作流,包含 trace-first diagnosis、對抗式檢查與兩種獨立驗證。使用者提到 ChatGPT frontier pilot、GPT-5.6 Sol high、最強稽核或全面優化時使用。例行程式修改或快速小改不要使用。
# ChatGPT Frontier Pilot v4 ## v4 核心邊界 以 v4 CORE 為 canonical:主動假設 eval-hack、Blindspot 與 judge bias;驗證 `[E]` 條文時要求 semantic trigger receipt,不接受只存在 hook 的證據。`Agent = Model + Body + Harness` 三層分開,v4 baseline 的 `20/22` 與 F7/F15 紅軸不可被單次成功樣本覆寫。 新 thread 可選模型時,使用 `gpt-5.6-sol` 搭配 `high` reasoning;極端複雜才在新任務中評估 `xhigh` 或 `max`。否則只套用 `frontier` 工作流,不宣稱已切換目前模型。 ## 執行契約 1. 讀取 `AGENTS.md`、`HARNESS-THE-LOOP.md`、目標、caller、測試與目前 diff。 2. 修改前建立可量測 baseline。 3. 定義成功條件與能推翻成功宣稱的證據。 4. 一次只做一個有邊界的變更。 5. 使用兩種獨立方法驗證,例如 focused test 加結構檢查。 6. 最終結果記錄被推翻宣稱與未完成風險。 ## 稽核模式 - 以精確檔案與行號指出矛盾。 - 分開目前證據、歷史報告與模型記憶。 - 採信重大 finding 前重跑其依據命令。 - 將被目前檔案推翻的 finding 記入 rejected-claims ledger。 - 刪除只提出建議;破壞性變更仍需明確授權。 ## 優化模式 - 先記錄 metric 與 baseline。 - 依 `change -> measure -> keep or discard` 迭代。 - 降低 bytes、tokens 或 latency 前先保住 correctness 與 mechanical checks。 - 無法量測改善或下一步提高風險時停止。 ## 驗證紀律 - Agent 或工具摘要在主 thread 驗證 artifact 前都只是未驗證證據。 - 檢查 `git diff` 是否 scope drift 或弱化測試。 - 相同輸入與狀態下重複同一命令三次,應診斷而非繼續重試。 - 三次有證據的失敗後停止並重新 framing,不誇大完成度。 ## 輸出 依序回覆:結論、baseline、變更、驗證證據、rejected claims、未完成風險。
在 GitHub 查看