moe-training
について
このスキルは、DeepSpeedまたはHuggingFaceを使用したMixture of Experts(MoE)モデルのトレーニングを可能にし、大規模トレーニングにおいて密なモデルと比較して5倍のコスト削減を実現します。Mixtral 8x7Bのようなスパースアーキテクチャの実装や、計算量の比例増加なしにモデル容量をスケーリングするのに理想的です。本スキルでは、MoEアーキテクチャ、ルーティング、負荷分散、エキスパート並列処理、および推論最適化について扱います。
クイックインストール
Claude Code
推奨npx skills add davila7/claude-code-templates -a claude-code/plugin add https://github.com/davila7/claude-code-templatesgit clone https://github.com/davila7/claude-code-templates.git ~/.claude/skills/moe-trainingこのコマンドをClaude Codeにコピー&ペーストしてスキルをインストールします
GitHub リポジトリ
よくある質問
moe-training Skillとは何ですか?
moe-training はdavila7 が作成した Claude Skillです。Skillは、Claudeが必要に応じて読み込む指示とリソースをまとめ、追加の指示なしで moe-training に関連するタスクを実行できるようにします。
moe-training をインストールするには?
このページのインストールコマンドを使用してください。moe-training をプラグインとして Claude Code に追加するか、リポジトリを skills ディレクトリにクローンし、Claudeを再起動してSkillを読み込みます。
moe-training はどのカテゴリに属しますか?
moe-training は その他 カテゴリに属します。
moe-training は無料で利用できますか?
はい。moe-training は AIMCP に掲載されており、無料でインストールできます。
関連スキル
LlamaGuardは、暴力やヘイトスピーチなど6つの安全性カテゴリーにおいて、LLMの入力と出力をモデレートするMetaの70-80億パラメータモデルです。94〜95%の精度を提供し、vLLM、Hugging Face、Amazon SageMakerを使用してデプロイ可能です。このスキルを使用して、AIアプリケーションにコンテンツフィルタリングと安全策を簡単に統合できます。
このClaudeスキルは、スポーツベッティング市場(スプレッド、オーバー/アンダー、プロップベットなど)を分析し、過去の傾向や状況統計を検証することでバリューベットを特定します。教育目的のための実践的な提案を構造化されたマークダウン形式で出力します。開発者はスポーツベッティング分析ツールとして本機能を活用できますが、娯楽および教育目的に限定されている点に留意してください。
このClaudeスキルは、リソースの適正サイジング、タグ付け戦略、支出分析を通じて、開発者がクラウドコストを最適化することを支援します。AWS、Azure、GCPにわたるクラウド支出の削減とコストガバナンスの実施のためのフレームワークを提供します。インフラコストの分析、リソースの適正サイジング、または予算制約への対応が必要な際にご利用ください。
このスキルは、bitsandbytesを使用してLLMを8ビットまたは4ビット精度に量子化し、精度の低下を最小限に抑えつつ50〜75%のメモリ削減を実現します。限られたGPUメモリでより大規模なモデルを実行したり、推論を高速化するのに理想的で、INT8、NF4、FP4などのフォーマットをサポートしています。HuggingFace Transformersと統合され、QLoRAトレーニングや8ビットオプティマイザーを可能にします。
