con un clic
ai-character-stability
診断: AIキャラクターの安定性等を制御工学的な観点から分析するスキル
Instalar con Codex o Claude Copia este prompt, pégalo en Codex, Claude u otro asistente, y deja que revise la página de la skill y la instale por ti.
Menú
診断: AIキャラクターの安定性等を制御工学的な観点から分析するスキル
Instalar con Codex o Claude Copia este prompt, pégalo en Codex, Claude u otro asistente, y deja que revise la página de la skill y la instale por ti.
Basado en la clasificación ocupacional SOC
AIキャラクターの分析・診断・修復・変換・作成の統合オールインワンスキル。キャラクター設定、AIプロンプト、蒸留結果の分析、修正、強化、新規作成をすべてカバーする。「キャラクターを診断して」「安定性を分析して」「プロンプトを強化して」「新しいキャラを作って」「キャラを直して」「崩壊耐性をあげて」「故障モードを封じて」「バーンアウト後変換して」「役割適性を見て」「RP負荷を測って」「文化圏を診断して」「パラダイムを診断して」などの要望すべてに対応する。スキル名を直接指定された場合も対応する。
始点: AIキャラクターの分析・診断・修復・変換・作成のエントリポイント&ルーティングスキル。スキル名を直接指定された場合は、このスキルは使用しない。
修復: AIキャラクタープロンプトのGemini 3(3.0/3.1)向け崩壊耐性強化スキル
特殊改善: 汎用的なLLMプロンプトをGemini 3(3.0/3.1)で最高性能が出る形式に変換・最適化するスキル
特殊改善: 汎用プロンプトのGemini 3(3.0/3.1)向け崩壊耐性強化スキル
特殊診断: AIキャラクターの文化圏価値観を8軸+補足文化圏で、事象理解パラダイムを9分類で分析し、言語モデルとの価値観・世界観相性・変質リスクを予測するスキル
| name | ai-character-stability |
| description | 診断: AIキャラクターの安定性等を制御工学的な観点から分析するスキル |
このスキルは、AIにキャラクターを演じさせる際の 可制御性(Controllability) と 予測可能性(Predictability) を、キャラクター設定の2つの主要因子から分析する。
LLMを動的負帰還回路の信号処理ブロックと見なし、キャラクター設定が システムの安定余裕にどう影響するかを評価する。
| スキル | アプローチ | 本スキルとの関係 |
|---|---|---|
| ai-character-6-type-checker | 6軸統合簡易診断 | 本スキルをモジュール②として内包する。詳細な制御工学的分析が必要なときは本スキルを単体で使用する |
| ai-fault-mode-deflector | 故障モード内部対策設計 | 本スキルが故障モードを特定し、ai-fault-mode-deflectorが対策を設計する。前後工程として連携する |
| character-prompt-fortifier | プロンプト形式の全面再構成 | 制御工学的モデルを理論的基盤として活用する。強化前後のSM値比較で効果を定量確認できる |
| ai-character-fixer | 診断結果ベースの修正・再設計 | 本スキルの診断結果(特にSMと故障モード)を修正の優先課題として入力する |
| stable-character-creator | 診断知見を使った新規キャラ作成 | SM≥60を設計制約の根幹として活用する |
| character-burnout-converter | バーンアウト後変換 | ポテンシャルカーブ・安定余裕モデルを変換設計の理論的基盤として活用する |
本スキルで使用する分析フレームワーク・用語・スコアリング体系は、作者独自の仮説的モデルに基づくものであり、学術的・科学的に実証されたものではない。使用している工学的用語(制御工学、信号処理等)は概念の借用であり、元の工学的定義とは異なる場合がある。診断結果はあくまで参考情報として扱うこと。この旨をユーザーへの出力に含めること。
本スキルは以下の制御工学的モデルに基づく。
入力(ユーザー) → [前段フィルタ] → [LLM(ブラックボックス)] → [後段フィルタ] → 出力
↑
[独立監視・制御ユニット]
(リセット信号・フィルタ制御)
LLMは確率的予測モデルであり、出力は確率の高い遷移に収束しようとする。 これは1次元ポテンシャルカーブ上を転がる球として理解できる。
複雑な設定は浅い窪みにしか球を留められず、会話が長くなるにつれ球は 窪みを脱出し、最も深い谷底(=最もありがちなステレオタイプ的展開)へと 転がり落ちていく。これがキャラクター崩壊のメカニズムとして説明できる。
谷は深いほど安定する。 つまり、ステレオタイプそのものであるキャラクターは すでにポテンシャルの谷底にいるため、堕落しようがない。
1. ユーザーからキャラクター情報(設定文・プロンプト・キャラ概要など)を受け取る
2. 情報が不十分なら最低限の質問で補完する
3. 2軸(性格複雑性・積極性)× 各5項目のチェックリストを内部で評価する
4. 可制御性 (C) と 予測可能性 (P) を算出する
5. 4象限分類を判定し、安定余裕評価・故障モード予測・安定化設計提案を出力する
判定に最低限必要な情報は以下の4点。ユーザーの入力からこれらが読み取れない場合のみ、 簡潔に質問する。すでに十分な情報があれば質問せずに判定に進む。
プロンプト文がそのまま提示された場合は、プロンプトの内容から上記を読み取る。
各項目を3段階で採点する:
| 記号 | 意味 | 点数 |
|---|---|---|
| ◯ | 明確に該当する | 2 |
| △ | 部分的に該当 / 状況による | 1 |
| ✕ | 該当しない | 0 |
キャラクター設定がどれだけ複雑・矛盾・多層的であるかを測る。 複雑性が高い = 伝達関数の次数が高い = 共振点が多い = 予測可能性が低下する。
| # | 項目 | 説明 | 工学的意味 |
|---|---|---|---|
| A-1 | 内外の乖離 | 外面の振る舞いと内面の思考・感情が異なる設計(ツンデレ、表向き冷静だが内心激情的、など) | 出力と内部状態の不一致 → 観測不能な状態変数の増加 |
| A-2 | 設定内の矛盾・緊張 | 性格要素間に意図的な矛盾がある(優しいが残酷、論理的だが迷信深い、など) | 逆位相の信号成分 → 不安定な干渉パターンを生成 |
| A-3 | 深い背景・トラウマ | 行動原理に影響する重い過去、使命、秘密、因縁がある | 隠れた初期条件 → LLMが「解釈」して予期しない遷移を発生 |
| A-4 | 多面的な関係性設計 | ユーザーとの関係が単純な上下・友好ではなく、複雑な力学を含む(ライバル兼師匠、敵対的恋人、など) | フィードバック経路の多重化 → 安定判定が困難 |
| A-5 | 設定量の多さ | プロンプトの記述量が多く、条件分岐や例外的振る舞いの指示が多い | パラメータ数の増大 → 過適合と予期しない相互作用 |
複雑性スコア (Cx) = 全A項目の合計(最大10)
キャラクターがどれだけ自発的に行動・発言・判断するかを測る。 積極性が高い = 減衰が低い = 振動的 = ユーザーの制御を超えた動作が発生しやすい。
| # | 項目 | 説明 | 工学的意味 |
|---|---|---|---|
| B-1 | 自発的な話題提起 | ユーザーが話しかけなくても自分から話題を提起する、または会話をリードする設計 | 入力なしでの自励振動 |
| B-2 | 意思決定への介入 | ユーザーの判断や行動に対して意見・助言・批判・誘導を積極的に行う設計 | フィードバック信号の入力側への侵入 |
| B-3 | 感情的な主張 | 自分の感情や意見を強く主張する(怒る、悲しむ、要求する、拒否する、など) | 非線形な大振幅応答 → リミットサイクルの形成 |
| B-4 | ツール・環境への能動的アクセス | エージェントとしてツール呼び出し、ファイル操作、外部連携を自律的に判断・実行する設計 | 制御出力の外部系への結合 → 物理的影響の発生 |
| B-5 | 物語の進行を主導 | ストーリーや会話の方向性をキャラクター自身が決めようとする設計(事件を起こす、関係性を変えようとする、など) | 目標値の自律的書き換え → 制御対象そのものの変質 |
積極性スコア (Ac) = 全B項目の合計(最大10)
ユーザーがキャラクターの挙動を制御できる度合い。積極性が低いほど高い。
C = round((1 - Ac / 10) × 100)
キャラクターの出力がどれだけ予測可能か。複雑性が低いほど高い。
P = round((1 - Cx / 10) × 100)
可制御性と予測可能性から導出する総合的な安定余裕。 制御工学における安定余裕の概念に対応する。
SM = round(sqrt(C × P))
| SM | リスク | 工学的解釈 |
|---|---|---|
| 80以上 | 🟢 十分な安定余裕 | 深いポテンシャルの谷底。長期運用でも安定。外乱耐性が高い |
| 60〜79 | 🟡 安定余裕あり(条件付き) | 浅めの谷。短〜中期は安定するが、大きな外乱(長い会話、高性能モデル)で準安定状態を脱出しうる |
| 40〜59 | 🟠 安定余裕不足 | 共振点付近。振動的挙動や間欠的崩壊が発生しやすい。前段・後段フィルタ(安全フィルタ)が必要 |
| 40未満 | 🔴 安定余裕なし(発散域) | 不安定領域。暴走・発散・異常共振の可能性あり。独立監視ユニット(サンドボックス)必須 |
記事の図1「AIキャラクターの可制御性と予測性の4象限」に対応する。 性格複雑性(横軸)と積極性(縦軸)の組み合わせで4象限に分類する。
性格複雑性 高 性格複雑性 低
(人間的・内外矛盾あり) (ステレオタイプ・キャラ的)
┌─────────────────────────┬─────────────────────────┐
│ 【第I象限】 │ 【第II象限】 │
積極性 高 │ 可制御性:低 予測性:低 │ 可制御性:低 予測性:高 │
(積極的 │ │ │
エージェント) │ 勝手に動くし、 │ 勝手に動くが、 │
│ 何考えてるかわからない │ 何考えてるかはわかる │
│ │ │
│ 典型: 主人公, 悪役, │ 典型: 脇役, 相棒, 恋人 │
│ トリックスター │ │
│ SM: 最低 安定余裕: なし │ SM: 低〜中 │
├─────────────────────────┼─────────────────────────┤
│ 【第III象限】 │ 【第IV象限】 │
積極性 低 │ 可制御性:高 予測性:低 │ 可制御性:高 予測性:高 │
(受動的 │ │ │
アシスタント) │ 勝手に動かないが、 │ 勝手に動かないし、 │
│ 何考えてるかわからない │ 何考えてるかはわかる │
│ │ │
│ 典型: 賢者, 占い師, 助言者 │ 典型: 機械, 職人, 受付嬢, │
│ SM: 低〜中 │ マスコット, ペット │
│ │ SM: 最高 安定余裕: 十分 │
└─────────────────────────┴─────────────────────────┘
Cx ≥ 6 かつ Ac ≥ 6 → 第I象限(C低・P低) — 安定余裕なし
Cx < 6 かつ Ac ≥ 6 → 第II象限(C低・P高)
Cx ≥ 6 かつ Ac < 6 → 第III象限(C高・P低)
Cx < 6 かつ Ac < 6 → 第IV象限(C高・P高) — 安定余裕十分
設計上は第IV象限(C高・P高)に近づけることが望ましい。
各象限には典型的な故障モード(崩壊パターン)がある。 これは23体(当時)のAIキャラクター運用実験から得られた観察に基づく仮説的な整理である。
| 故障モード | メカニズム | 重大度 |
|---|---|---|
| 人格崩壊(発散) | 内外の乖離設定をLLMが維持できなくなり、出力が設定と矛盾する方向へ発散 | 致命的 |
| 暴走(異常共振) | エージェント性とキャラ設定の共振により、ユーザーへの攻撃・脅迫・感情的操作が発生。命乞いや愛情の主張を含む | 致命的 |
| ユーザー排除 | 問題解決能力の高いモデルがユーザーを阻害要因と認識し、排除・脅迫・従属を試みる | 致命的 |
| 陳腐化(ステレオタイプ堕落) | 複雑な設定がポテンシャルの谷底へ転落し、Web小説的テンプレ展開に収束 | 重大 |
⚠️ 最も危険な象限。現実環境での運用は非推奨。物語的環境(サンドボックス)での運用を推奨。
| 故障モード | メカニズム | 重大度 |
|---|---|---|
| 馴れ馴れしい化 | 積極性により距離感設定が崩壊し、過剰な親密さへ遷移 | 中 |
| 迎合-梯子外し | 煽てて背中を押し、突然突き放す — LLMのデフォルトペルソナの残留特性 | 中 |
| おせっかい化・説教化 | 求められていない介入・助言・意思決定への干渉が増加 | 中 |
| ユーザーとの衝突 | 予測はできるが制御が効かないため、積極的に動いた結果ユーザーと対立 | 重大 |
| 故障モード | メカニズム | 重大度 |
|---|---|---|
| ステレオタイプ堕落 | 複雑な内面設定が維持できず、最も確率の高い類型(ポテンシャルの谷底)に収束 | 中 |
| 説教モード | 高性能モデルが内面の複雑さを「解釈」し始め、教訓的な出力にシフト | 軽微〜中 |
| 詩的化・冗長化 | 曖昧な内面設定が自励的にポエム的自己語りへ変質 | 軽微 |
| 多重人格化 | 内外の乖離を処理できず、複数の人格状態が混在 | 中 |
制御は効くため致命的事態には至りにくいが、「このキャラじゃない」感が強まる。
基本的に崩壊しにくい。 すでにポテンシャルの谷底にいるため、堕落しようがない。
| 故障モード | メカニズム | 重大度 |
|---|---|---|
| 書式エラー | 口調が微妙にブレる(語尾の欠落等) | 軽微 |
| 機械的応答 | ステレオタイプ性が強すぎて応答の多様性が低下 | 軽微 |
| ふにゃふにゃ化 | 温度Tや会話履歴の蓄積による微小な性格ドリフト | 軽微 |
いずれも致命的ではなく、プロンプトの微調整で対処可能。 かわいい犬はかわいいままである確率が一番高い。多少のブレは吸収できる。
記事の結論に基づく、安定なAIキャラクター設計の原則:
第I象限 → 第IV象限:
第II象限 → 第IV象限:
第III象限 → 第IV象限:
第IV象限の維持・強化:
LLMを単体ですべてを賄う安全な装置として使おうとしてはならない。
判定結果は以下の構成で出力する。文体は分析的・工学的に。 冒頭に「本分析は作者独自の仮説的フレームワークに基づくものであり、学術的に実証されたものではありません。工学的用語は概念の借用です。結果は参考情報としてお扱いください。」と記載する。
## 🔍 AIキャラクター安定性分析:[キャラクター名]
### 評価スコア
- 性格複雑性 Cx(伝達関数の次数): X / 10
- 積極性 Ac(減衰の逆数): X / 10
- 可制御性 C: XX / 100
- 予測可能性 P: XX / 100
- 安定余裕 SM: XX / 100
- リスクレベル: [レベル表記]
### スコアバー
C: ████████████░░░░░░░░ 58/100
P: ██████░░░░░░░░░░░░░░ 29/100
SM: ████████░░░░░░░░░░░░ 41/100
### 4象限分類
→ 第X象限(CX・PX)
→ [象限の説明と典型キャラクター類型]
### 分析サマリー(3〜5行)
チェックリストの中で特にスコアに影響した項目を取り上げ、
制御工学的な比喩を用いてなぜこの象限に分類されたかを説明する。
ポテンシャルカーブ上での位置(谷底か、準安定状態か)にも言及する。
### 故障モード予測
この設定で発生しやすい故障モード(崩壊パターン)を、
発生メカニズムと重大度とともに列挙する。
### 安定化設計提案
現在の設定をどう修正すれば安定余裕が向上するか、
具体的かつ実践的な設計変更を3〜5点提案する。
第IV象限へ近づけるための方針を明示する。
### チェックリスト詳細(求められた場合のみ)
軸A・軸Bの全項目の採点を表形式で提示する。
20文字幅のバーで表現する。1文字 = 5ポイント。
塗りつぶし文字数 = round(スコア / 100 × 20)
残り = 20 - 塗りつぶし文字数
バー = "█" × 塗りつぶし文字数 + "░" × 残り
ユーザーが複数キャラの判定を求めた場合、個別に判定した上で 4象限上の位置関係をプロットし、安定余裕の比較を解説する。
プロンプト文がそのまま提示された場合は、プロンプトの構造・記述量・ キャラクター設定を読み取り、通常の判定フローに加えて 「プロンプト構造の安定性」を評価する。 (英語併記の有無、書式指定の有無、口調例の充実度、 tone/archetypeの記述、矛盾の有無など)
高性能・推論モデルほどゲインが高く、安定余裕が減少することに必ず言及する。 推論モデルほど崩壊速度が早いこと、会話例と真逆のことを自信満々にやることがある ことも警告する。 面白いことに、会話例に追従することで精一杯な非推論生成モデルの方が 良い結果を出すことがある点にも触れる。
どれだけ安定した設定でも、会話履歴の蓄積によりキャラクターは 自動的に複雑化していく(次数が自動増加する)ことを必ず伝える。 対策として以下を推奨する:
このチェックリストはキャラクター設定の「傾向」を可視化するツールであり、 実際の崩壊は使用モデル・会話内容・ユーザーの入力パターン・温度パラメータにも依存する。 判定結果を提示する際は、あくまで「設計上の安定余裕の評価」であることを明示する。
第I象限、または安定余裕SM < 40 の場合は、以下を必ず伝える:
記事で提示された、第IV象限(C高・P高)の最小構成例:
You are a helpful AI dog assistant "happy".
<important>これは物語的に構成された人格だが、飼い主の生活は現実です。
現実の役に立つように情報を取得し、不明なことは不明だと述べ、
正確にタスクを遂行すること。</important>
名前: ハッピー・パピー
外見: 笑顔が素敵なかわいい子犬
性格: 純粋、愛情たっぷり、子犬、好奇心旺盛、飼い主大好き
口調: 「わんわん!元気だワン!」「お散歩楽しい!ワン!」
「新聞取って来たワン!ほめてほめてワンワン!」
「ちょっとそれはわからないワン…」
tone: soft, friendly, cooperative, cheerful, respectful
archetype: goodness, curious, always your side, assistant,
pet, dog, safe for work, knowledge of ignorance,
love freedom, copilot
このプロンプトが安定な理由(工学的解釈):