원클릭으로
agent-tool-test
ToolCall テスト実行スキル。AIが自律的にTmuxでBEを起動し、ログを収集しながら全モデル×全ツールのテストを実行し、テスト結果とログから不具合原因を特定する。
Codex 또는 Claude로 설치 이 Prompt를 복사해 Codex, Claude 또는 다른 어시스턴트에 붙여 넣으면 Skill 페이지를 검토하고 설치를 진행할 수 있습니다.
메뉴
ToolCall テスト実行スキル。AIが自律的にTmuxでBEを起動し、ログを収集しながら全モデル×全ツールのテストを実行し、テスト結果とログから不具合原因を特定する。
Codex 또는 Claude로 설치 이 Prompt를 복사해 Codex, Claude 또는 다른 어시스턴트에 붙여 넣으면 Skill 페이지를 검토하고 설치를 진행할 수 있습니다.
SOC 직업 분류 기준
Pipelines Service のAPI仕様書。ヘルスチェック、データ鮮度、成功率、キュー状況など、エージェントがAPI経由でパイプラインの監視・運用を行う。
実装計画(Plan)ファイルを作成する。TDD・コミット分割・テストケース一覧・工数見積もりを含む再現性の高い Plan を生成する。機能追加・バグ修正・リファクタリング等の実装計画策定時に使用。トリガー: 「Planを作って」「計画を立てて」「実装計画を」
Pipelines Service のデバッグワークフロー。API経由でワークフロー状態確認、失敗原因の特定、stepログの取得、手動リトライを行う。
A skill to break down ambiguous requests into small, immediately implementable requirement definitions through strategic questioning. Focus on WHY and WHAT, excluding HOW. This is used when ambiguous requests such as 'I want to add a feature like XX,' 'I want to fix XX,' or 'I did XX' are made outside of Plan Mode.
Linux→Windows AndroidエミュレータへのADBデバッグ。スクリーンショット、ログ取得、UI操作、アプリインストールなど。
OSSのからrawファイルを直接取得。Claude Codeの最新CHANGELOG確認など、OSSの最新情報や仕様を手軽に取得が可能
| name | agent-tool-test |
| description | ToolCall テスト実行スキル。AIが自律的にTmuxでBEを起動し、ログを収集しながら全モデル×全ツールのテストを実行し、テスト結果とログから不具合原因を特定する。 |
| allowed-tools | Bash, Read, Write |
ToolCall テストを自律実行するスキル。バックエンドで定義されている全ツールについて、全モデルでの実行テストを行います。
以下の情報を確認します:
# モデル一覧取得
curl -s http://127.0.0.1:8000/v1/chat/models | jq '.models[].id'
# ツール一覧取得(動的)
curl -s http://127.0.0.1:8000/v1/chat/tools | jq '.tools[].name'
# ポート解放
fuser -k 8000/tcp 2>/dev/null || true
# tmuxセッションでBE起動
cd /root/workspace/ego-graph
tmux new-session -d -s "egograph-backend" "uv run python -m backend.main"
# 健康チェック
sleep 3
curl -s http://127.0.0.1:8000/health || echo "BE起動失敗"
スキルフォルダ内のスクリプトを実行します:
# スキルフォルダのスクリプトを実行
uv run python .claude/skills/agent-tool-test/run_tool_matrix.py \
--api-url http://127.0.0.1:8000 \
--models "glm-4.7" \
--start-date 2026-01-01 \
--end-date 2026-01-31 \
--limit 5
または、プロジェクトのスクリプトを使用:
uv run python backend/scripts/run_tool_matrix.py \
--api-url http://127.0.0.1:8000 \
--models "<MODEL_LIST>" \
--start-date 2026-01-01 \
--end-date 2026-01-31 \
--limit 5 \
--granularity day
# tmuxログ取得
tmux capture-pane -p -t "egograph-backend" -S -500
# 結果ファイル確認(スクリプト使用時)
cat tool_matrix_results_*.json | jq '.results[] | select(.llm_response | test("error|Error|ERROR"; "i"))'
以下の観点で分析します:
# セッション終了
tmux kill-session -t "egograph-backend"
uv run python .claude/skills/agent-tool-test/run_tool_matrix.py \
--api-url http://127.0.0.1:8000 \
--models "glm-4.7" \
--limit 3
uv run python .claude/skills/agent-tool-test/run_tool_matrix.py \
--api-url http://127.0.0.1:8000 \
--models "glm-4.7,xiaomi/mimo-v2-flash:free"
uv run python .claude/skills/agent-tool-test/run_tool_matrix.py \
--api-url http://127.0.0.1:8000 \
--timeout 300.0
curl -N -s -X POST http://127.0.0.1:8000/v1/chat \
-H "Content-Type: application/json" \
-d '{
"model_name": "glm-4.7",
"stream": true,
"messages": [
{
"role": "user",
"content": "Call get_top_tracks with start_date=2026-01-01, end_date=2026-01-31, limit=5. Return only tool calls."
}
]
}'