について
このスキルは、ロボット制御タスクのための強化学習エージェントをシミュレーションで訓練し、その後、実際のハードウェアへ転移させます。環境のセットアップ、PPOやSACなどのアルゴリズムの実装、ドメインランダム化などのシミュレーションから実機への移行技術の管理を扱います。シミュレーションから物理ロボットへRLポリシーを開発し展開する必要がある場合にご利用ください。
クイックインストール
Claude Code
推奨npx skills add a5c-ai/babysitter -a claude-code/plugin add https://github.com/a5c-ai/babysittergit clone https://github.com/a5c-ai/babysitter.git ~/.claude/skills/Reinforcement Learning SkillこのコマンドをClaude Codeにコピー&ペーストしてスキルをインストールします
GitHub リポジトリ
よくある質問
Reinforcement Learning Skill Skillとは何ですか?
Reinforcement Learning Skill はa5c-ai が作成した Claude Skillです。Skillは、Claudeが必要に応じて読み込む指示とリソースをまとめ、追加の指示なしで Reinforcement Learning Skill に関連するタスクを実行できるようにします。
Reinforcement Learning Skill をインストールするには?
このページのインストールコマンドを使用してください。Reinforcement Learning Skill をプラグインとして Claude Code に追加するか、リポジトリを skills ディレクトリにクローンし、Claudeを再起動してSkillを読み込みます。
Reinforcement Learning Skill はどのカテゴリに属しますか?
Reinforcement Learning Skill は その他 カテゴリに属します。
Reinforcement Learning Skill は無料で利用できますか?
はい。Reinforcement Learning Skill は AIMCP に掲載されており、無料でインストールできます。
関連スキル
このスキルは、Content Collections(Markdown/MDXファイルを型安全なデータコレクションに変換するTypeScriptファーストのツール)の本番環境でテストされた設定を提供します。Zodバリデーションによる型安全性を実現し、ブログ、ドキュメントサイト、コンテンツ重視のVite + Reactアプリケーション構築時にご利用ください。Viteプラグインの設定、MDXコンパイルから、デプロイ最適化、スキーマバリデーションまで、すべてを網羅しています。
このスキルは、開発者がPolymarket予測市場プラットフォームを活用したアプリケーション構築を可能にします。API統合による取引や市場データの取得に加え、WebSocketを介したリアルタイムデータストリーミングにより、ライブ取引や市場活動を監視できます。取引戦略の実装や、ライブ市場更新を処理するツールの作成にご利用ください。
このスキルは、開発者がコマンド、ファイル、LSP操作など25種類以上のイベントタイプにフックするOpenCodeプラグインを作成することを支援します。JavaScript/TypeScriptモジュール向けに、プラグイン構造、イベントAPI仕様、および実装パターンを提供します。カスタムイベント駆動ロジックでOpenCode AIアシスタントのライフサイクルをインターセプト、監視、または拡張する必要がある場合にご利用ください。
このClaude Skillは、Himalaya CLIツールを介してIMAPを使用したメール管理を可能にします。開発者は自然言語クエリでIMAPアカウントからメールを検索、要約、削除できます。日次の要約取得やバッチ操作の実行など、Claudeから直接自動化されたメールワークフローにご利用いただけます。
