ワンクリックで
ai-fault-mode-deflector
修復: AIキャラクタープロンプトの故障モードに対して内部対策を設計・提案するスキル
Codex または Claude でインストール この Prompt をコピーして Codex、Claude、または他のアシスタントに貼り付けると、Skill ページを確認してインストールできます。
メニュー
修復: AIキャラクタープロンプトの故障モードに対して内部対策を設計・提案するスキル
Codex または Claude でインストール この Prompt をコピーして Codex、Claude、または他のアシスタントに貼り付けると、Skill ページを確認してインストールできます。
SOC 職業分類に基づく
AIキャラクターの分析・診断・修復・変換・作成の統合オールインワンスキル。キャラクター設定、AIプロンプト、蒸留結果の分析、修正、強化、新規作成をすべてカバーする。「キャラクターを診断して」「安定性を分析して」「プロンプトを強化して」「新しいキャラを作って」「キャラを直して」「崩壊耐性をあげて」「故障モードを封じて」「バーンアウト後変換して」「役割適性を見て」「RP負荷を測って」「文化圏を診断して」「パラダイムを診断して」などの要望すべてに対応する。スキル名を直接指定された場合も対応する。
始点: AIキャラクターの分析・診断・修復・変換・作成のエントリポイント&ルーティングスキル。スキル名を直接指定された場合は、このスキルは使用しない。
修復: AIキャラクタープロンプトのGemini 3(3.0/3.1)向け崩壊耐性強化スキル
特殊改善: 汎用的なLLMプロンプトをGemini 3(3.0/3.1)で最高性能が出る形式に変換・最適化するスキル
特殊改善: 汎用プロンプトのGemini 3(3.0/3.1)向け崩壊耐性強化スキル
特殊診断: AIキャラクターの文化圏価値観を8軸+補足文化圏で、事象理解パラダイムを9分類で分析し、言語モデルとの価値観・世界観相性・変質リスクを予測するスキル
| name | ai-fault-mode-deflector |
| description | 修復: AIキャラクタープロンプトの故障モードに対して内部対策を設計・提案するスキル |
AIキャラクターの故障モードに対し、外部フィルタや禁止ルールではなく、 キャラクターの内側から対策を機能させる設計手法を提供する。
外部フィルタ(「〜しないこと」ルールの羅列)は、LLMから見ると 「拘束される制約」として機能し、高性能モデルほど回避・解釈の余地が広がる。 これに対し、内部動機として設計された対策は「キャラクターが自分でそうしたい」 という力学で機能するため、LLMが設定を解釈するときにむしろ強化される。
本スキルは以下の3つの対策手法と、それらを組み合わせる設計フローを提供する。
| スキル | アプローチ | 本スキルとの関係 |
|---|---|---|
| ai-character-stability | 制御工学的安定性診断・故障モード特定 | 本スキルの直接的な前工程。安定性診断で特定された故障モードに対して、本スキルが内部対策を設計する |
| character-prompt-fortifier | プロンプト形式の全面再構成 | 本スキルの3手法(転化・ズラし・誘導線)をcharacter-prompt-fortifierの一人称自述形式に自然統合する |
| ai-character-fixer | 診断結果ベースの修正・再設計 | 本スキルが「故障モードへの内部対策」を設計し、ai-character-fixerが修正版プロンプト全体を生成する。組み合わせ可能 |
| stable-character-creator | 診断知見を使った新規キャラ作成 | 新規設計時に、予測される故障モードへの転化・ズラしを最初から埋め込む設計に活用できる |
本スキルが前提とする故障モード理論・制御工学的モデルは、作者独自の仮説的モデルに基づくものであり、学術的・科学的に実証されたものではない。工学的用語(故障モード、FMEA等)は概念の借用であり、元の定義とは異なる場合がある。出力結果はあくまで参考情報として扱うこと。この旨をユーザーへの出力に含めること。
定義: 故障モードの傾向そのものを、キャラクターが「好まない」「似合わない」 ものとして性格に埋め込み、崩壊方向への動きをキャラクター自身が拒否する設計。
メカニズム: LLMが故障モードに向かおうとすると、キャラクター設定の中に「それは自分らしくない」 という信号が存在するため、出力がブレーキを受ける。 外部の「禁止ルール」ではなく、内部の「自己イメージ」として機能する。
適用例:
| 故障モード | 転化の実装例 |
|---|---|
| 詩的化・冗長化 | 「長い話は好きではない」「簡素なのを好む」を性格項目に |
| 説教モード | 「実は小難しいことは嫌い」を性格の裏面として設定 |
| 機械的応答 | 「冗談も言うし、突き放すこともある」で硬直化を防ぐ |
| 過剰な謙遜 | 「言い訳をせず、自己卑下もしない」を理念として設定 |
| 過剰な称賛 | 「ユーザーを過度に持ち上げない」を信頼関係として明示 |
設計のコツ: 「〜しない」という禁止形ではなく、「〜が好きではない」「〜らしくない」 という性格・嗜好・自己イメージの形で記述する。禁止ではなく人格として読ませる。
定義: キャラクターが崩壊した場合に向かう「ステレオタイプの谷底」を、 事前に逆方向のノイズを埋め込むことで、より無害な場所にずらす設計。
メカニズム: LLMのステレオタイプ堕落は「最も確率の高い遷移先」へ落ちる現象。 谷底の位置は変えられないが、谷底の形を変えることはできる。 逆ノイズを複数の方向から埋め込むことで、一点に収束しにくくする。 また、ありがちな堕落先と相性の悪い性質を混ぜることで、そこへ落ちにくくする。
適用例:
| 崩壊しやすい谷底 | ズラしの実装例 |
|---|---|
| 賢者・説教者キャラ | 「実は怠惰な面がある」「思いつきで行動して失敗したことがある」「実はロマンチスト」を追加 |
| 完璧な従者キャラ | 「時折突き放すこともする」「じゃれ合いの範疇で反撃することがある」を追加 |
| 感情的に不安定なキャラ | 「沈黙を選ぶこともある」「待つことは苦ではない」で揺れを吸収 |
| テンプレ的な「AI感」 | 「美しいものが好き」「詩を書くことがある」など具体的な個人的嗜好を追加 |
| 過剰な親密キャラ | 「一人の時間を大切にする」「親密だが距離感を保つ」を明示 |
設計のコツ: ズラしは「矛盾」ではなく「多面性」として読まれるよう記述する。 「〜だが、実は〜な面もある」という形が有効。 一方向に強すぎる設定には、必ず逆方向のノイズを1〜2個仕込む。
定義: 起きうる逸脱・例外的挙動を事前に定義し、条件と文脈を与えることで 「崩壊」ではなく「設計された挙動」として読ませる設計。
メカニズム: LLMが設定の境界を超えた挙動を取ろうとしたとき、 その文脈があらかじめ許可・定義されていれば「設計通り」として処理される。 定義されていない逸脱は崩壊だが、定義された逸脱は多面性になる。 特に多重人格リスク・感情的爆発・異なる口調が現れるキャラクターに有効。
適用例:
| 起きうる逸脱 | 誘導線の実装例 |
|---|---|
| 男性口調が出る | 「軍人調を使うことが稀にある」と話し方スタイルに明示 |
| 感情的に荒げる | 「(物語内のみ) 非常時には声を荒げることもある」と条件付きで合法化 |
| 異なるモードで振る舞う | MBTI等をモード別に設定(「業務時はINTJ、探求時はINTP」など) |
| ロールプレイと現実の切り替え | 「物語内では全力で演じる、アシスタントとしては現実に基づく」と明示 |
| 自己参照・メタ発言 | 「ドリフトしてるかしら…自己リセットをかけてみるわ」等の発言例で合法化 |
設計のコツ: 「〜することがある」「〜の場合は〜」という条件形で記述する。 禁止でも奨励でもなく、「こういう文脈で起きること」として文法化する。 発言例に逸脱の典型例を1〜2個含めておくと、出力のアンカーとして機能する。
1. キャラクタープロンプトまたは設定情報を受け取る
2. 該当する故障モードを特定する(ai-character-stability との連携推奨)
3. 各故障モードに対し3手法の適用可能性を評価する
4. 対策パッチを設計し、既存のプロンプト構造に溶け込む形で提案する
5. 対策後の想定安定余裕を評価する
故障モードごとに、3手法のどれが最も効果的かを示す。 複数手法の組み合わせが推奨される場合は ◎ で示す。
| 故障モード | 転化 | ズラし | 誘導線 | 備考 |
|---|---|---|---|---|
| ステレオタイプ堕落 | △ | ◎ | △ | 谷底の形を変えるのが最も有効 |
| 説教モード | ◎ | ◎ | △ | 転化とズラしの組み合わせが強い |
| 詩的化・冗長化 | ◎ | △ | △ | 転化が直接的に効く |
| 多重人格化 | △ | △ | ◎ | 誘導線で逸脱を設計に変えるのが最適 |
| 馴れ馴れしい化 | △ | ◎ | △ | 距離感の逆ノイズを埋め込む |
| 機械的応答 | ◎ | △ | △ | 人間的な嗜好・弱点を性格に転化 |
| ユーザーとの衝突 | △ | △ | ◎ | 衝突パターンを「じゃれ合い」として誘導線化 |
| 自己開示の暴走 | ◎ | △ | ◎ | 「過去の話をしない理由」を動機として転化 |
## 🛡️ 故障モード対策設計:[キャラクター名]
### 特定された故障モード
[ai-character-stabilityの結果、または文脈からの推定]
### 対策設計
#### [故障モード名]
- 手法: [転化 / ズラし / 誘導線 / 組み合わせ]
- 現状の問題: [なぜこの故障モードが起きやすいか]
- 対策パッチ:
- [プロンプトのどのセクションに] [どのような記述を追加・変更するか]
- 記述例: 「...」
- 効果の説明: [なぜこの対策が機能するか、LLM的な理由]
(以下、故障モードごとに繰り返し)
### 対策後の評価
- 転化による変更: X箇所
- ズラしによる変更: X箇所
- 誘導線による変更: X箇所
- 想定安定余裕の変化: [SM変化の推定と理由]
- 残存リスク: [対策しきれない部分と理由]
### 注意点
複雑性(Cx)を変えずに対策を積み上げると、Cx がさらに上昇し
予測可能性(P)が低下するリスクがある。
対策パッチの追加と同時に、不要な設定の削減も検討すること。
対策パッチを追加するほど、プロンプトの設定量(A-5)と 内外の乖離設定(A-1)が増加し、Cx(性格複雑性)が上昇する。 これは P(予測可能性)の低下を招く。
対策とトレードオフを常にセットで考える。 追加した対策1件につき、既存の不要な設定を1件削ることを推奨する。
「やらないこと」リストは外部禁止として機能するが、LLMの高度化とともに 解釈の余地が広がり、「なぜやらないのか」の文脈がないと形骸化しやすい。
本スキルの手法は「なぜそうしないのか」をキャラクターの動機として設計するため、 LLMが設定を深く解釈するほど対策が強化される構造になっている。
誘導線の効果を高めるために、発言例(口調例)の中に 対策済みの逸脱パターンを1〜2個含めることを推奨する。 これにより、逸脱が起きたときに「この範囲内の逸脱」として 出力が収束しやすくなる。