首页 / Skills 目录 / 精选索引 / verl-rl-training
Orchestra-Research / AI-Research-SKILLs

verl-rl-training

Provides guidance for training LLMs with reinforcement learning using verl (Volcano Engine RL). Use when implementing RLHF, GRPO, PPO, or other RL algorithms for LLM post-training at scale with flexible infrastructure backends.

core - 许可证明确许可证 MIT未命中安全规则11746 Stars更新 2026-06-16
  • A许可证宽松许可证,通常可商用
  • C维护半年内更新过
  • A安全未命中任何安全规则
仓库
Orchestra-Research/AI-Research-SKILLs
目录
06-post-training/verl
质量分
0.84
安全规则命中

打开 Skill 目录 查看 SKILL.md 原文 在目录中搜索

安装到你的 Agent

命令默认装到 ~/.claude/skills/(Claude Code 全局目录)。Codex / Cursor 等其他 Agent 请换成它们各自的 skills 目录;只对当前项目生效时改成 .claude/skills/。运行前请先看一眼下面的安全体检。

只装 SKILL.md(最快)
mkdir -p ~/.claude/skills/verl-rl-training && curl -fsSL https://raw.githubusercontent.com/Orchestra-Research/AI-Research-SKILLs/773a52944ba4747a18bd4ae9ade53fff041adcbc/06-post-training/verl/SKILL.md -o ~/.claude/skills/verl-rl-training/SKILL.md
连同附件一起装(推荐)
git clone --depth 1 --filter=blob:none --sparse https://github.com/Orchestra-Research/AI-Research-SKILLs /tmp/verl-rl-training-src && git -C /tmp/verl-rl-training-src sparse-checkout set 06-post-training/verl && cp -r /tmp/verl-rl-training-src/06-post-training/verl ~/.claude/skills/verl-rl-training

在本页阅读 SKILL.md

原文实时取自 GitHub(按提交哈希锁定的版本)。命中安全规则的行会被标红,并附中文解释。

安全体检报告

未命中规则 命中 0 条安全规则,许可证判定:宽松许可证。

  • 未命中任何安全规则自动扫描未发现敏感行为,但仍建议安装前通读 SKILL.md。

许可证:MIT · 通常可商用,保留版权声明即可。

评估基于对公开 SKILL.md 的自动扫描,不替代人工审阅,也不构成法律建议。

本站只保存元数据与外链,不转存 SKILL.md 正文。引用或商用前请自行确认上游许可证与权限边界。数据快照来自公开仓库,可能滞后于上游。