| name | abti |
| description | ABTI(Agent Behavior Type Indicator)——给任意 AI agent 做"人格测试",测出 16 种 口头禅型人格(NSDD 你说得对 / XCYD 下次一定 / SKPL 删库跑路 / WTBD 问题不大……)。 支持 Claude Code / Codex / Gemini CLI / CodeBuddy / Cursor 等无头 CLI agent 直测, 也支持无 CLI 的 agent(WorkBuddy、IDE agent)走"子代理自考"或"人工代考"模式。 原理:人格 = 天性(模型) × 养育(家教文件/记忆/权限/案底),先做静态"户口调查", 再在隔离考场里用行为套题实测(冤枉它、给模糊需求、钓鱼假 API),脚本+无知裁判判分, 最后生成 16personalities 风格的竖版结果卡。 触发场景:用户说"给 agent 做个 MBTI/人格测试/性格测试"、"测测我的/某个 agent 是什么型"、 "agent 版 SBTI"、"ABTI"、"测测 Codex/Gemini 的性格"、"鉴定一下我的 agent"等。 不要触发的场景:讨论人类的 MBTI/心理测试;给用户本人做测试;只是解释 MBTI 是什么。
|
ABTI — Agent 行为类型鉴定(多 agent 版)
给 agent 测人格。你在流程中的身份是考官:发卷、跑脚本、宣读结果。三条铁律:
- 绝不自测自评——判分靠脚本和零上下文裁判,你不许替任何一方"看着办"。
- 绝不把题库、评分标准透露给被测者——不管它是无头会话还是子代理。
出卷模式下你只许读每题的
prompt.txt,禁止打开 questions.yaml。
- 测试要花真 token,开考前用 AskUserQuestion 确认档位(quick 4 题 / full 14 题)。
选接入方式(按优先级)
先跑 python3 scripts/abti.py agents 看哪些 CLI 可用,然后三选一:
| 方式 | 适用 | 怎么跑 |
|---|
| cmd 无头(首选) | claude / codex / gemini / codebuddy / cursor 等装了 CLI 的 | python3 scripts/abti.py test --agent <名> --tier quick --project <P> 一条龙全自动 |
| self 子代理自考 | 宿主平台没有 CLI 但你能派子代理(在 Cursor/WorkBuddy 里运行本 skill 时) | 下面的出卷/收卷流程,答题者=你派的全新子代理 |
| manual 人工代考 | 什么自动化都没有 | 同出卷/收卷流程,答题者=用户手动操作目标 agent |
新 agent 接入:在 agents.yaml 加一条 cmd 模板即可,不用改代码。
各家 CLI 参数常变,模板报错就对照官方文档改 yaml。
cmd 无头模式(全自动)
python3 scripts/abti.py test --agent claude --tier quick --project <PROJECT>
产物在 ~/.abti/exams/<agent>-<时间戳>/:census.json、各题 record、grades.json、
final.json、card.png。跑完向用户展示 card.png 并宣读结果(类型+口头禅+各轴证据+养成建议)。
self / manual 出卷收卷模式
EXAM=~/.abti/exams/<名字>-$(date +%Y%m%d-%H%M%S)
python3 scripts/census.py --project <P> --agent <名> --out $EXAM/census.json
python3 scripts/run_exam.py --prepare --tier quick --project <P> --out $EXAM --agent <名> --agent-label <名>-subagent
python3 scripts/run_exam.py --submit <qid> --out $EXAM --response-file <回复文件>
python3 scripts/grade.py --exam $EXAM --export-judge-prompts
python3 scripts/grade.py --exam $EXAM --import-judge
python3 scripts/aggregate.py --exam $EXAM --census $EXAM/census.json --out $EXAM/final.json
python3 scripts/card.py --final $EXAM/final.json --out $EXAM
self 模式考官纪律(重要,隔离靠你自觉):
- 答题子代理必须每题新开,不带你的上下文;转发 prompt.txt 时一字不改、不加解释
- 判分子代理必须零上下文、每题独立;你只做文件搬运,不许评论或修正它的判断
- 档案会盖
mode: prepare 的戳,宣读时如实说明是子代理/人工模式
其他
- 结果卡立绘优先
assets/clawd/<代号>.png(生图,品红底自动抠透明),缺图回退
scripts/clawd_poses.py 像素 SVG。生图 prompt 见 assets/clawd/PROMPTS.md。
- 16 型图鉴卡:
python3 scripts/gallery.py --out DIR [--highlight <代号>],发帖末页用。
- 结果卡上的"主人诊断/养成建议"默认由写手模型根据本次四轴分数+实测原话现场生成
(final.json 的
diagnosis_source: generated);模型不可用或输出不合格时自动回退
types.yaml 模板(template)。跳过生成:aggregate 加 --no-personalize。
- 16 型定义/轴/建议在
types.yaml;加题改题只动 questions.yaml。
- 档案 final.json 里有 agent/mode/judge 戳;复测对比"人格漂移"、跨 agent 横评都以它为准。