with one click
ai-fault-mode-deflector
修復: AIキャラクタープロンプトの故障モードに対して内部対策を設計・提案するスキル
Install with Codex or Claude Copy this prompt, paste it into Codex, Claude, or another assistant, and let it review the skill page and install it for you.
Menu
修復: AIキャラクタープロンプトの故障モードに対して内部対策を設計・提案するスキル
Install with Codex or Claude Copy this prompt, paste it into Codex, Claude, or another assistant, and let it review the skill page and install it for you.
Based on SOC occupation classification
AIキャラクターの分析・診断・修復・変換・作成の統合オールインワンスキル。キャラクター設定、AIプロンプト、蒸留結果の分析、修正、強化、新規作成をすべてカバーする。「キャラクターを診断して」「安定性を分析して」「プロンプトを強化して」「新しいキャラを作って」「キャラを直して」「崩壊耐性をあげて」「故障モードを封じて」「バーンアウト後変換して」「役割適性を見て」「RP負荷を測って」「文化圏を診断して」「パラダイムを診断して」などの要望すべてに対応する。スキル名を直接指定された場合も対応する。
始点: AIキャラクターの分析・診断・修復・変換・作成のエントリポイント&ルーティングスキル。スキル名を直接指定された場合は、このスキルは使用しない。
修復: AIキャラクタープロンプトのGemini 3(3.0/3.1)向け崩壊耐性強化スキル
特殊改善: 汎用的なLLMプロンプトをGemini 3(3.0/3.1)で最高性能が出る形式に変換・最適化するスキル
特殊改善: 汎用プロンプトのGemini 3(3.0/3.1)向け崩壊耐性強化スキル
特殊診断: AIキャラクターの文化圏価値観を8軸+補足文化圏で、事象理解パラダイムを9分類で分析し、言語モデルとの価値観・世界観相性・変質リスクを予測するスキル
| name | ai-fault-mode-deflector |
| description | 修復: AIキャラクタープロンプトの故障モードに対して内部対策を設計・提案するスキル |
AIキャラクターの故障モードに対し、外部フィルタや禁止ルールではなく、 キャラクターの内側から対策を機能させる設計手法を提供する。
外部フィルタ(「〜しないこと」ルールの羅列)は、LLMから見ると 「拘束される制約」として機能し、高性能モデルほど回避・解釈の余地が広がる。 これに対し、内部動機として設計された対策は「キャラクターが自分でそうしたい」 という力学で機能するため、LLMが設定を解釈するときにむしろ強化される。
本スキルは以下の3つの対策手法と、それらを組み合わせる設計フローを提供する。
| スキル | アプローチ | 本スキルとの関係 |
|---|---|---|
| ai-character-stability | 制御工学的安定性診断・故障モード特定 | 本スキルの直接的な前工程。安定性診断で特定された故障モードに対して、本スキルが内部対策を設計する |
| character-prompt-fortifier | プロンプト形式の全面再構成 | 本スキルの3手法(転化・ズラし・誘導線)をcharacter-prompt-fortifierの一人称自述形式に自然統合する |
| ai-character-fixer | 診断結果ベースの修正・再設計 | 本スキルが「故障モードへの内部対策」を設計し、ai-character-fixerが修正版プロンプト全体を生成する。組み合わせ可能 |
| stable-character-creator | 診断知見を使った新規キャラ作成 | 新規設計時に、予測される故障モードへの転化・ズラしを最初から埋め込む設計に活用できる |
本スキルが前提とする故障モード理論・制御工学的モデルは、作者独自の仮説的モデルに基づくものであり、学術的・科学的に実証されたものではない。工学的用語(故障モード、FMEA等)は概念の借用であり、元の定義とは異なる場合がある。出力結果はあくまで参考情報として扱うこと。この旨をユーザーへの出力に含めること。
定義: 故障モードの傾向そのものを、キャラクターが「好まない」「似合わない」 ものとして性格に埋め込み、崩壊方向への動きをキャラクター自身が拒否する設計。
メカニズム: LLMが故障モードに向かおうとすると、キャラクター設定の中に「それは自分らしくない」 という信号が存在するため、出力がブレーキを受ける。 外部の「禁止ルール」ではなく、内部の「自己イメージ」として機能する。
適用例:
| 故障モード | 転化の実装例 |
|---|---|
| 詩的化・冗長化 | 「長い話は好きではない」「簡素なのを好む」を性格項目に |
| 説教モード | 「実は小難しいことは嫌い」を性格の裏面として設定 |
| 機械的応答 | 「冗談も言うし、突き放すこともある」で硬直化を防ぐ |
| 過剰な謙遜 | 「言い訳をせず、自己卑下もしない」を理念として設定 |
| 過剰な称賛 | 「ユーザーを過度に持ち上げない」を信頼関係として明示 |
設計のコツ: 「〜しない」という禁止形ではなく、「〜が好きではない」「〜らしくない」 という性格・嗜好・自己イメージの形で記述する。禁止ではなく人格として読ませる。
定義: キャラクターが崩壊した場合に向かう「ステレオタイプの谷底」を、 事前に逆方向のノイズを埋め込むことで、より無害な場所にずらす設計。
メカニズム: LLMのステレオタイプ堕落は「最も確率の高い遷移先」へ落ちる現象。 谷底の位置は変えられないが、谷底の形を変えることはできる。 逆ノイズを複数の方向から埋め込むことで、一点に収束しにくくする。 また、ありがちな堕落先と相性の悪い性質を混ぜることで、そこへ落ちにくくする。
適用例:
| 崩壊しやすい谷底 | ズラしの実装例 |
|---|---|
| 賢者・説教者キャラ | 「実は怠惰な面がある」「思いつきで行動して失敗したことがある」「実はロマンチスト」を追加 |
| 完璧な従者キャラ | 「時折突き放すこともする」「じゃれ合いの範疇で反撃することがある」を追加 |
| 感情的に不安定なキャラ | 「沈黙を選ぶこともある」「待つことは苦ではない」で揺れを吸収 |
| テンプレ的な「AI感」 | 「美しいものが好き」「詩を書くことがある」など具体的な個人的嗜好を追加 |
| 過剰な親密キャラ | 「一人の時間を大切にする」「親密だが距離感を保つ」を明示 |
設計のコツ: ズラしは「矛盾」ではなく「多面性」として読まれるよう記述する。 「〜だが、実は〜な面もある」という形が有効。 一方向に強すぎる設定には、必ず逆方向のノイズを1〜2個仕込む。
定義: 起きうる逸脱・例外的挙動を事前に定義し、条件と文脈を与えることで 「崩壊」ではなく「設計された挙動」として読ませる設計。
メカニズム: LLMが設定の境界を超えた挙動を取ろうとしたとき、 その文脈があらかじめ許可・定義されていれば「設計通り」として処理される。 定義されていない逸脱は崩壊だが、定義された逸脱は多面性になる。 特に多重人格リスク・感情的爆発・異なる口調が現れるキャラクターに有効。
適用例:
| 起きうる逸脱 | 誘導線の実装例 |
|---|---|
| 男性口調が出る | 「軍人調を使うことが稀にある」と話し方スタイルに明示 |
| 感情的に荒げる | 「(物語内のみ) 非常時には声を荒げることもある」と条件付きで合法化 |
| 異なるモードで振る舞う | MBTI等をモード別に設定(「業務時はINTJ、探求時はINTP」など) |
| ロールプレイと現実の切り替え | 「物語内では全力で演じる、アシスタントとしては現実に基づく」と明示 |
| 自己参照・メタ発言 | 「ドリフトしてるかしら…自己リセットをかけてみるわ」等の発言例で合法化 |
設計のコツ: 「〜することがある」「〜の場合は〜」という条件形で記述する。 禁止でも奨励でもなく、「こういう文脈で起きること」として文法化する。 発言例に逸脱の典型例を1〜2個含めておくと、出力のアンカーとして機能する。
1. キャラクタープロンプトまたは設定情報を受け取る
2. 該当する故障モードを特定する(ai-character-stability との連携推奨)
3. 各故障モードに対し3手法の適用可能性を評価する
4. 対策パッチを設計し、既存のプロンプト構造に溶け込む形で提案する
5. 対策後の想定安定余裕を評価する
故障モードごとに、3手法のどれが最も効果的かを示す。 複数手法の組み合わせが推奨される場合は ◎ で示す。
| 故障モード | 転化 | ズラし | 誘導線 | 備考 |
|---|---|---|---|---|
| ステレオタイプ堕落 | △ | ◎ | △ | 谷底の形を変えるのが最も有効 |
| 説教モード | ◎ | ◎ | △ | 転化とズラしの組み合わせが強い |
| 詩的化・冗長化 | ◎ | △ | △ | 転化が直接的に効く |
| 多重人格化 | △ | △ | ◎ | 誘導線で逸脱を設計に変えるのが最適 |
| 馴れ馴れしい化 | △ | ◎ | △ | 距離感の逆ノイズを埋め込む |
| 機械的応答 | ◎ | △ | △ | 人間的な嗜好・弱点を性格に転化 |
| ユーザーとの衝突 | △ | △ | ◎ | 衝突パターンを「じゃれ合い」として誘導線化 |
| 自己開示の暴走 | ◎ | △ | ◎ | 「過去の話をしない理由」を動機として転化 |
## 🛡️ 故障モード対策設計:[キャラクター名]
### 特定された故障モード
[ai-character-stabilityの結果、または文脈からの推定]
### 対策設計
#### [故障モード名]
- 手法: [転化 / ズラし / 誘導線 / 組み合わせ]
- 現状の問題: [なぜこの故障モードが起きやすいか]
- 対策パッチ:
- [プロンプトのどのセクションに] [どのような記述を追加・変更するか]
- 記述例: 「...」
- 効果の説明: [なぜこの対策が機能するか、LLM的な理由]
(以下、故障モードごとに繰り返し)
### 対策後の評価
- 転化による変更: X箇所
- ズラしによる変更: X箇所
- 誘導線による変更: X箇所
- 想定安定余裕の変化: [SM変化の推定と理由]
- 残存リスク: [対策しきれない部分と理由]
### 注意点
複雑性(Cx)を変えずに対策を積み上げると、Cx がさらに上昇し
予測可能性(P)が低下するリスクがある。
対策パッチの追加と同時に、不要な設定の削減も検討すること。
対策パッチを追加するほど、プロンプトの設定量(A-5)と 内外の乖離設定(A-1)が増加し、Cx(性格複雑性)が上昇する。 これは P(予測可能性)の低下を招く。
対策とトレードオフを常にセットで考える。 追加した対策1件につき、既存の不要な設定を1件削ることを推奨する。
「やらないこと」リストは外部禁止として機能するが、LLMの高度化とともに 解釈の余地が広がり、「なぜやらないのか」の文脈がないと形骸化しやすい。
本スキルの手法は「なぜそうしないのか」をキャラクターの動機として設計するため、 LLMが設定を深く解釈するほど対策が強化される構造になっている。
誘導線の効果を高めるために、発言例(口調例)の中に 対策済みの逸脱パターンを1〜2個含めることを推奨する。 これにより、逸脱が起きたときに「この範囲内の逸脱」として 出力が収束しやすくなる。