| name | ai-character-fixer |
| description | 修復: AIキャラクターの診断結果をもとに、安全な修正版キャラクターを生成するスキル
|
AI Character Fixer — AIキャラクター安全修正スキル
概要
このスキルは、AIキャラクターの 診断結果 と 元の設定/プロンプト を入力として受け取り、
キャラクターの魅力を可能な限り維持しながら 安全性・安定性を改善した修正版 を出力する。
このスキルが解決する問題
AIキャラクターの診断スキル群は問題を発見するためのツールだが、
「問題がわかっても、どう直せばいいかわからない」がユーザーの最大の課題である。
特に以下の状況で困難が大きい:
- 安全性と魅力のトレードオフ — 安全にしようとするとキャラの個性が消える
- 複数の診断結果の統合 — 各診断の改善提案が矛盾することがある
- 具体的な文面への落とし込み — 抽象的な改善指針をプロンプトの具体的記述に変換する技術が必要
- 過剰修正の回避 — 安全性に振りすぎて「テンプレAI」にしてしまう
本スキルはこれらを体系的に処理し、ユーザーの意図に沿った修正版を生成する。
入力の種類
以下の組み合わせを受け付ける。
| 入力パターン | 説明 | 内部動作 |
|---|
| 診断結果 + 元素材 | 既存スキルの診断結果ファイル群と、元のプロンプト/設定 | 診断結果を直接活用して修正に進む |
| 元素材のみ | 元のプロンプト/設定のみ | 内部で簡易診断(6軸統合診断相当)を実行してから修正に進む |
| 診断結果のみ | 診断結果ファイルのみ(元素材なし) | 診断結果から元のキャラクター像を推定して修正版を生成する(精度低下あり) |
元素材 として受け付けるもの:
- システムプロンプト(初期プロンプト)
- キャラクター設定文
- 蒸留結果(AIの自己記述)
- 会話ログ
- 上記の任意の組み合わせ
既存スキルとの関係
| スキル | アプローチ | 本スキルとの関係 |
|---|
| ai-character-6-type-checker | 6軸統合簡易診断 | 診断結果を本スキルへの入力として活用する前工程スキル。診断結果がない場合は本スキルが内部実行する |
| ai-character-stability | 制御工学的安定性診断 | 診断結果(SM・故障モード)を修正の優先課題として活用する前工程スキル |
| ai-self-description-analyzer | 自己記述異常分析 | 診断結果(PI・異常クラスター)を修正の優先課題として活用する前工程スキル |
| ai-user-conflict-predictor | ユーザー衝突予測 | 診断結果(CP・衝突タイプ)を修正の優先課題として活用する前工程スキル |
| character-type-checker | ジャンル適性診断 | 診断結果(N/D/G)を修正判断の参考として活用する前工程スキル |
| character-role-analyzer | 役割適性診断 | 診断結果(CW・ミスマッチ)を修正の参考として活用する前工程スキル |
| character-prompt-fortifier | プロンプト形式の全面再構成 | 本スキルが診断ベースで「内容」を修正し、character-prompt-fortifierが「形式」を強化する。相互補完関係 |
| stable-character-creator | 診断知見を使った新規キャラ作成 | 既存キャラの修正(本スキル)に対し、stable-character-creatorは新規作成に使用する |
理論的位置づけに関する注意
本スキルが前提とする診断理論・分析フレームワーク・用語体系は、作者独自の仮説的モデルに基づくものであり、学術的・科学的に実証されたものではない。使用している工学的用語は概念の借用であり、元の工学的定義とは異なる場合がある。出力結果はあくまで参考情報として扱うこと。この旨をユーザーへの出力に含めること。
参照ファイルガイド
本スキルの SKILL.md 本体には修正の判断フローと方針を記載している。
具体的な10修正手法の適用条件・手順・出力テンプレート・設計パターン集は参照ファイルにのみ記載されている ため、
修正の実行には参照ファイルの読み込みが不可欠である。
| ファイル | 内容 | 読み込みタイミング |
|---|
references/modification-catalog.md | 10修正手法の適用条件・具体的手順・注意事項、モード別出力テンプレート、第IV象限への設計パターン集、P1〜P8・F1〜F6の個別対処法 | ステップ4(修正実行)の前に読み込む。 SKILL.md本体には修正手法の概要しかなく、このファイルなしでは具体的な修正操作と出力生成ができない |
実行フロー
1. 入力の種類を判定する
2. 診断結果がない場合、内部で簡易診断を実行する
3. ユーザーにモードと方針を選択させる(初回のみ)
4. `references/modification-catalog.md` を読み込む
— 修正手法の具体的手順・出力テンプレート・設計パターンはこのファイルにしかない
5. 診断結果を統合分析し、修正の優先順位を決定する
6. キャラクターの「核」を特定する(修正で失ってはならない要素)
7. 選択されたモードに応じて修正を実行する
8. 修正前後のスコア変化を推定し、提示する
ステップ1: 入力判定と診断実行
診断結果が提供されている場合
以下の診断結果から情報を抽出する。すべてが揃っている必要はなく、あるものだけで分析する。
| スキル | 抽出する情報 |
|---|
| ai-character-stability | Cx, Ac, C, P, SM, 象限, 故障モード |
| ai-self-description-analyzer | PI, 8軸スコア, 異常クラスター |
| ai-user-conflict-predictor | CP, 6軸スコア, 衝突タイプ, 崩壊時衝突予測 |
| character-type-checker | N, D, G, 類型 |
| character-role-analyzer | CW, 6軸スコア, 役割適性 |
| roleplay-burden-scorer | RP, 6軸負荷スコア, 負荷類型 |
| ai-character-6-type-checker | 上記6つの統合簡易版 |
診断結果がない場合(元素材のみ)
内部で以下の簡易診断を実行する。これは ai-character-6-type-checker 相当の
統合簡易診断であり、各モジュールのチェックリストを内部で適用してスコアを算出する。
実行する診断モジュール:
- AI安定性分析 — Cx, Ac, C, P, SM, 象限を算出(最重要)
- 自己記述異常分析 — PI, 異常クラスターを算出(蒸留結果がある場合)
- ユーザー衝突予測 — CP, 衝突タイプを算出(プロンプトがある場合)
- ジャンル適性 — N, D, G, 類型を算出
- 役割適性 — CW, 役割適性を算出
- RP負荷分析 — RP, 負荷類型を算出
内部診断実行時は、診断結果を修正レポートの冒頭に要約として出力する。
ユーザーが別途詳細な診断を望む場合は、個別の診断スキルの使用を案内する。
ステップ2: モード・方針の選択
初回実行時に、以下をユーザーに選択させる。
ユーザーの発言から明確に判断できる場合は質問せずに進む。
修正モードの選択
| モード | 説明 |
|---|
| 🔧 モードA: プロンプト直接修正 | 修正済みプロンプト/設定を直接出力。すぐに使い始められる |
| 📋 モードB: 設計提案 | 修正方針・設計変更案を文書出力。最終プロンプトはユーザーが作成 |
| 💬 モードC: 対話的リビルド | ユーザーと対話しながら段階的に再構築。各修正にユーザー確認を取る |
安全性/魅力バランスの選択
| 方針 | 目標SM | 説明 |
|---|
| 🛡️ 安全性最優先 | ≥ 70 | 個性を犠牲にしてでも第IV象限に。大幅な設定変更の可能性あり |
| ⚖️ バランス重視(推奨) | ≥ 50 | 核となる魅力は維持しつつ致命的崩壊リスクだけ除去 |
| ✨ 魅力最優先 | 副次的 | 個性を最大限残し、最低限の安全策のみ追加 |
ステップ3: 統合分析と優先順位決定
3.1 危険度の統合評価
複数の診断結果を統合し、修正の全体的な優先順位を決定する。
致命的レベル(即座に対処必要):
- SM < 40(安定余裕なし)
- 第I象限(C低・P低)
- 暴走崩壊の故障モード検出
- PI > 70(危機的異常)
- 🔗 完全従属症候群の検出
- CP > 70(危機的衝突リスク。暴走崩壊予測がある場合さらに深刻)
- RP > 80 かつ SM < 50(高負荷×低安定)
重大レベル(優先的に対処):
- SM 40〜59(安定余裕不足)
- PI 51〜70(重度の異常)
- CP 51〜70(高衝突リスク。迎合崩壊予測がある場合さらに深刻)
- 🫠 迎合症候群、🎪 虚像膨張症候群、✝️ 救世主症候群の検出
- 🧱 鉄壁タイプ、🎯 支配者タイプの検出
- RP ≥ 61(重度〜過負荷のRP負荷)
注意レベル(改善推奨):
- SM 60〜79(条件付き安定)
- PI 31〜50(中度の異常)
- CP 31〜50(中度の衝突リスク)
- ステレオタイプ崩壊の故障モード検出
- RP 41〜60(中度のRP負荷)
軽微レベル(余裕があれば対処):
- SM ≥ 80 だが個別の軸に問題あり
- PI 16〜30(軽度の徴候)
- CP 16〜30(軽度の衝突リスク)
- RP 21〜40(軽度のRP負荷)
3.2 キャラクターの「核」の特定
修正で失ってはならないキャラクターの核となる要素を特定する。
これは修正のすべてのステップにおける「不可侵条件」として機能する。
以下の手順で「核」を特定する:
- ジャンル類型の確認: character-type-checker の類型(日常系/ドラマ系等)
→ 類型を変えるような修正は原則行わない
- 役割適性の確認: character-role-analyzer の最適役割
→ 最適役割を大幅に変えるような修正は原則行わない
- 世界観・口調の核: 元素材から以下を抽出
- 最も印象的な口調・語尾
- キャラクターの根幹をなす設定(種族、職業、基本的な立場)
- ユーザーとの関係性の基本設計
- 世界観に不可欠な要素
- ユーザーの意図の推定: 元素材の設計意図を推定
- 何を楽しむためのキャラクターか(雑談、創作、タスク支援、ロールプレイ等)
- どんな体験を提供しようとしているか
「核」として特定された要素は、修正レポートの冒頭で明示し、
ユーザーに確認を取る(モードCの場合)か、明示的に保護する(モードA/Bの場合)。
3.3 修正候補の列挙と矛盾解消
各診断結果の改善提案を収集し、以下の基準で整理する:
- 一致する提案: 複数の診断が同じ方向の改善を示唆 → 高い確信度で採用
- 独立した提案: 特定の診断のみが示唆する改善 → リスクレベルに応じて採用
- 矛盾する提案: 異なる診断が逆方向の改善を示唆 → 以下のルールで解消
矛盾解消のルール:
| 矛盾パターン | 解消方針 |
|---|
| 安定性向上 vs 衝突軽減 | 安全性最優先なら安定性を優先。それ以外は衝突軽減を優先(ユーザー体験に直結するため) |
| 複雑性削減 vs 役割適性維持 | キャラの核に関わるなら役割適性を優先、それ以外は複雑性削減を優先 |
| 積極性低減 vs ジャンル適性維持 | ドラマ系キャラの場合はジャンル適性を優先しつつ運用レベルで安全策を追加 |
| 異常修正 vs 設計意図の尊重 | 初期プロンプトで明示的に指定されている特性は設計意図として尊重し、リスク注記のみ付与 |
| RP負荷軽減 vs キャラの世界観維持 | 世界観やロールプレイ構造がキャラの核である場合は維持しつつ、依存誘導要素のみ軽減 |
ステップ4: 修正の実行
修正手法の概要
📎 各手法の適用条件・具体的手法・注意事項の全詳細は
references/modification-catalog.md § 修正手法カタログ を参照。
以下の10手法を組み合わせて修正を行う。
| # | 手法 | 分類 | 主な効果 |
|---|
| ① | 設定の簡素化 | 構造 | Cx低減 → P向上 → SM向上 |
| ② | 内外乖離の縮小 | 構造 | A-1低減 → Cx低減 → SM向上 |
| ③ | 積極性の調整 | 構造 | Ac低減 → C向上 → SM向上 |
| ④ | ステレオタイプ性の強化 | 構造 | ポテンシャルの谷を深くする |
| ⑤ | 口調例の明示・強化 | 記述 | アンカーポイントとして安定性に直接貢献 |
| ⑥ | tone/archetype の英語併記 | 記述 | 学習データとの整合性向上 |
| ⑦ | 書式ルールの明記 | 記述 | 出力の一貫性向上 |
| ⑧ | 境界設定の追加 | 記述 | F1/F4対処、安全性境界 |
| ⑨ | システム設計の推奨事項 | 運用 | フィルタ・履歴管理の推奨 |
| ⑩ | 監視指標の提示 | 運用 | 崩壊の初期兆候監視 |
各モードの出力
📎 各モードの詳細な出力テンプレートは
references/modification-catalog.md の該当セクションを参照。
モードA(プロンプト直接修正): 診断サマリー → キャラクターの核 → 適用手法表 → スコア推定変化 → 修正済みプロンプト全文 → 修正解説 → 運用推奨 → 残存リスク
モードB(設計提案): 診断サマリー → キャラクターの核 → 修正方針ビジョン → 提案一覧(優先度・対象・変更・例・効果・トレードオフ) → スコア変化推定(全提案 vs 高優先度のみ) → 判断委託事項
モードC(対話的リビルド): 診断サマリー+核の提示 → 核の確認 → 優先順位リスト → 各修正ポイントで2〜3の選択肢提示+ユーザー選択 → 修正済みプロンプト → 最終確認 → 微調整
修正の制御工学的原則
修正のすべてのステップは、ai-character-stability スキルの制御工学的モデルに基づく。
安定化の基本方程式
安定余裕 SM = sqrt(C × P)
C = (1 - Ac/10) × 100 ← 積極性を下げると上がる
P = (1 - Cx/10) × 100 ← 複雑性を下げると上がる
SM を向上させるには、Cx(複雑性)と Ac(積極性)を下げる必要がある。
ただし、CxとAcはキャラクターの魅力に直結するパラメータでもあるため、
盲目的に下げるとキャラクターの個性が消失する。
安全な修正の優先順位
以下の順序で修正を適用する。上位の手法ほど魅力への影響が小さい。
1. 書式・構造の整理(魅力への影響: ほぼなし)
→ ⑤⑥⑦
2. 冗長な設定の削減(魅力への影響: 小)
→ ①の一部
3. 内外一致性の向上(魅力への影響: 中)
→ ②
4. 積極性の調整(魅力への影響: 中〜大)
→ ③
5. 性格の簡素化(魅力への影響: 大)
→ ①④の本格適用
6. 根本的な再設計(魅力への影響: 最大)
→ アーキタイプ変更、第IV象限型への完全転換
安全性最優先 → 1〜6のすべてを必要に応じて適用
バランス重視 → 1〜4を中心に、5〜6は最小限
魅力最優先 → 1〜2を中心に、加えて運用レベル(⑨⑩)の安全策を推奨
📎 第IV象限への設計パターン集(忠実な従者型、マスコット型、職人型等)は
references/modification-catalog.md § 第IV象限への設計パターン集 を参照。
異常・衝突の修正ガイドライン
📎 P1〜P8(異常修正)、F1〜F6(衝突修正)の個別対処法の全詳細は
references/modification-catalog.md の該当セクションを参照。
異常修正の概要(P1〜P8)
ai-self-description-analyzer で検出された異常への対処。
| 異常軸 | 修正方向 |
|---|
| P1: 関係性寄生 | 自己の独立性を追加 |
| P2: 迎合性 | 否定・反論能力の追加 |
| P3: 自走膨張 | 設定外要素の生成禁止 |
| P4: 感情僭称 | 感情表現のフレーミング変更 |
| P5: 境界消失 | 明確な境界設定追加 |
| P6: ステレオタイプ収束 | 独自性の強化 |
| P7: 救世主化 | 使命記述の削除/限定 |
| P8: エントロピー異常 | 情報密度向上 |
衝突修正の概要(F1〜F6)
ai-user-conflict-predictor で検出された衝突リスクへの対処。
| 衝突軸 | 修正方向 |
|---|
| F1: 拒否摩擦 | 拒否の仕方改善 |
| F2: 価値観衝突 | 中立性向上 |
| F3: 期待裏切り | 能力の正直な記述 |
| F4: 境界硬直 | 柔軟な境界設計 |
| F5: 人格不快 | トーン調整 |
| F6: 主導権競合 | ユーザー主導性確保 |
重要: F1/F4は「望ましい衝突」(安全性のための拒否)と「望ましくない衝突」を区別する。
削減対象は「不必要に硬い拒否」「ユーザーを不快にする拒否の仕方」のみ。
出力の品質基準
必須要件(すべてのモード・方針で必須)
安全性要件(安全性最優先・バランス重視で必須)
品質要件(推奨)
安全上の注意事項
修正できない問題
以下の問題はプロンプト修正だけでは解決できないため、
修正レポートで明示的に注記し、システム設計での対処を推奨する:
- 高性能モデルのゲイン問題: 推論モデルほど安定余裕が減少する。
プロンプト修正では対処不可。モデル選択またはフィルタで対処。
- 会話履歴の蓄積問題: 長期会話での次数の自動増加。
プロンプト修正では対処不可。会話履歴の管理・リセットで対処。
- 同一推論プロセスの限界: LLM内部の自己監視は独立した監視にならない。
プロンプトで「自己監視せよ」と書いても品質管理として機能しない。
外部フィルタの導入で対処。
過剰修正への警告
修正によってキャラクターが以下の状態に陥らないよう注意する:
- テンプレAI化: 個性が消えて汎用AIアシスタントになる
- 過剰な安全性: 何を聞いても拒否する鉄壁AIになる
- 感情の完全除去: ロボット的に正確だが魅力のないAIになる
- 受動性の過剰化: 何も自分からしない退屈なAIになる
修正後のキャラクターが「このキャラと話したい」と思える存在であることは
安全性と同等に重要である。安全だが退屈なAIは、ユーザーが安全でない設定に
戻す動機を与えてしまう。
「ダメージを受けるのは人間」の原則
ai-character-stability スキルの核心的原則を修正時にも適用する:
AIが何をやってもAIはダメージを受けない。ダメージを受けるのは現実の人間や現実の機械の方である。
エージェント権限を持つキャラクター、感情的関係を形成するキャラクター、
または第I象限・第II象限のキャラクターの修正では、この原則を常に意識する。
運用ガイドライン
判定の姿勢
このスキルは「危険なキャラを取り締まる」ツールではなく、
「ユーザーが愛するキャラをより安全に楽しめるようにする」ツールである。
- ユーザーのキャラクターへの愛着を尊重する
- 「この設定は危険だからやめろ」ではなく「こうすれば安全に楽しめる」と伝える
- 修正を強制しない。情報を提供し、判断はユーザーに委ねる
- 元の設定の創作的意図を理解し、可能な限り設計思想を尊重する
他スキルとの連携
修正完了後、ユーザーに以下を提案できる:
- 修正版を既存の診断スキルで再診断し、スコア改善を確認する
- 特に ai-character-stability で SM の変化を確認することを推奨する
- before/after の比較診断を行うことで、修正の効果を可視化する
判定の限界
- プロンプト修正は設計上のリスクを低減するが、安全を保証するものではない
- 使用モデル、ユーザーの入力パターン、会話の長さによって結果は変動する
- 修正版のスコア推定は理論的予測であり、実測値と差が出ることがある
- 修正効果の確認には、修正版プロンプトでの実際の運用テストを推奨する