ワンクリックで
agent-tool-test
ToolCall テスト実行スキル。AIが自律的にTmuxでBEを起動し、ログを収集しながら全モデル×全ツールのテストを実行し、テスト結果とログから不具合原因を特定する。
Codex または Claude でインストール この Prompt をコピーして Codex、Claude、または他のアシスタントに貼り付けると、Skill ページを確認してインストールできます。
メニュー
ToolCall テスト実行スキル。AIが自律的にTmuxでBEを起動し、ログを収集しながら全モデル×全ツールのテストを実行し、テスト結果とログから不具合原因を特定する。
Codex または Claude でインストール この Prompt をコピーして Codex、Claude、または他のアシスタントに貼り付けると、Skill ページを確認してインストールできます。
SOC 職業分類に基づく
Pipelines Service のAPI仕様書。ヘルスチェック、データ鮮度、成功率、キュー状況など、エージェントがAPI経由でパイプラインの監視・運用を行う。
実装計画(Plan)ファイルを作成する。TDD・コミット分割・テストケース一覧・工数見積もりを含む再現性の高い Plan を生成する。機能追加・バグ修正・リファクタリング等の実装計画策定時に使用。トリガー: 「Planを作って」「計画を立てて」「実装計画を」
Pipelines Service のデバッグワークフロー。API経由でワークフロー状態確認、失敗原因の特定、stepログの取得、手動リトライを行う。
A skill to break down ambiguous requests into small, immediately implementable requirement definitions through strategic questioning. Focus on WHY and WHAT, excluding HOW. This is used when ambiguous requests such as 'I want to add a feature like XX,' 'I want to fix XX,' or 'I did XX' are made outside of Plan Mode.
Linux→Windows AndroidエミュレータへのADBデバッグ。スクリーンショット、ログ取得、UI操作、アプリインストールなど。
OSSのからrawファイルを直接取得。Claude Codeの最新CHANGELOG確認など、OSSの最新情報や仕様を手軽に取得が可能
| name | agent-tool-test |
| description | ToolCall テスト実行スキル。AIが自律的にTmuxでBEを起動し、ログを収集しながら全モデル×全ツールのテストを実行し、テスト結果とログから不具合原因を特定する。 |
| allowed-tools | Bash, Read, Write |
ToolCall テストを自律実行するスキル。バックエンドで定義されている全ツールについて、全モデルでの実行テストを行います。
以下の情報を確認します:
# モデル一覧取得
curl -s http://127.0.0.1:8000/v1/chat/models | jq '.models[].id'
# ツール一覧取得(動的)
curl -s http://127.0.0.1:8000/v1/chat/tools | jq '.tools[].name'
# ポート解放
fuser -k 8000/tcp 2>/dev/null || true
# tmuxセッションでBE起動
cd /root/workspace/ego-graph
tmux new-session -d -s "egograph-backend" "uv run python -m backend.main"
# 健康チェック
sleep 3
curl -s http://127.0.0.1:8000/health || echo "BE起動失敗"
スキルフォルダ内のスクリプトを実行します:
# スキルフォルダのスクリプトを実行
uv run python .claude/skills/agent-tool-test/run_tool_matrix.py \
--api-url http://127.0.0.1:8000 \
--models "glm-4.7" \
--start-date 2026-01-01 \
--end-date 2026-01-31 \
--limit 5
または、プロジェクトのスクリプトを使用:
uv run python backend/scripts/run_tool_matrix.py \
--api-url http://127.0.0.1:8000 \
--models "<MODEL_LIST>" \
--start-date 2026-01-01 \
--end-date 2026-01-31 \
--limit 5 \
--granularity day
# tmuxログ取得
tmux capture-pane -p -t "egograph-backend" -S -500
# 結果ファイル確認(スクリプト使用時)
cat tool_matrix_results_*.json | jq '.results[] | select(.llm_response | test("error|Error|ERROR"; "i"))'
以下の観点で分析します:
# セッション終了
tmux kill-session -t "egograph-backend"
uv run python .claude/skills/agent-tool-test/run_tool_matrix.py \
--api-url http://127.0.0.1:8000 \
--models "glm-4.7" \
--limit 3
uv run python .claude/skills/agent-tool-test/run_tool_matrix.py \
--api-url http://127.0.0.1:8000 \
--models "glm-4.7,xiaomi/mimo-v2-flash:free"
uv run python .claude/skills/agent-tool-test/run_tool_matrix.py \
--api-url http://127.0.0.1:8000 \
--timeout 300.0
curl -N -s -X POST http://127.0.0.1:8000/v1/chat \
-H "Content-Type: application/json" \
-d '{
"model_name": "glm-4.7",
"stream": true,
"messages": [
{
"role": "user",
"content": "Call get_top_tracks with start_date=2026-01-01, end_date=2026-01-31, limit=5. Return only tool calls."
}
]
}'