Главная · Тег
Rl
Rl в экосистеме Claude Code: 11 инструментов. Популярные: RL-обучение OpenClaw Aradotso, Stable-Baselines3 K-Dense научный, Stable-Baselines3 Claude шаблоны. У каждого — описание на русском, команда установки и ссылка на исходники.
openclaw-rl-training — RL-обучение OpenClaw Aradotso
aradotso/trending-skills
RL-обучение OpenClaw.
stable-baselines3 — Stable-Baselines3 K-Dense научный
k-dense-ai/scientific-agent-skills
Stable-Baselines3 для RL.
stable-baselines3 — Stable-Baselines3 Claude шаблоны
davila7/claude-code-templates
Stable-Baselines3 Claude.
grpo-rl-training — GRPO RL обучение Claude шаблоны
davila7/claude-code-templates
GRPO RL обучение.
verl-rl-training — обучение RL VeRL Orchestra Research
orchestra-research/ai-research-skills
Обучение RL через VeRL.
grpo-rl-training — GRPO RL обучение Orchestra Research
orchestra-research/ai-research-skills
GRPO Orchestra.
miles-rl-training — обучение MILES RL Orchestra Research
orchestra-research/ai-research-skills
Обучение MILES RL.
torchforge-rl-training — обучение RL TorchForge Orchestra Research
orchestra-research/ai-research-skills
Обучение RL через TorchForge.
slime-rl-training — обучение SLIME RL Orchestra Research
orchestra-research/ai-research-skills
Обучение SLIME с подкреплением.
rl-reward — награда RL AgentScope OpenJudge
agentscope-ai/openjudge
Функция награды для обучения с подкреплением.
AgentDB Learning Plugins — RL плагины для AgentDB агентов
spencermarx/open-code-review
Полный набор reinforcement learning плагинов для AgentDB: 9 алгоритмов от Q-learning до policy gradient для обучающихся агентов.