Skip to main content

rl-policy-optimization

Best practices for reinforcement learning policy optimization. Use when working on RL agents, PPO, SAC, or reward design.

インストールへ移動

ソース情報

リポジトリ
aiming-lab/AutoResearchClaw
ソースの最終更新活動
2026年3月23日 01:46
検出された SKILL.md の言語
英語
スター
13,974
フォーク
1,633

インストール方法

デフォルトでは、最初にソースを確認する Prompt が選択されています。直接コマンドに切り替えるか、ローカルコピーをダウンロードすることもできます。

ソースファイルを確認

インストールを決める前に、SKILL.md と SkillsMP に表示されている付属ファイルをお読みください。