跳到正文
原文
Hugging Face Blog·· 2025-06-03精选AI 评分62

TRL 支持 vLLM 与 GRPO 训练同卡共置

No GPU left behind: Unlocking Efficiency with Co-located vLLM in TRL

AI 导读

TRL 通过 PR #3394 支持 vLLM 的 external launcher,让推理与 GRPO 训练在同一批 GPU 上共置运行,不再需要单独的 vLLM 服务器进程。

推荐理由

TRL 把 vLLM 从独立推理服务改为与训练同卡共置,读者可据此判断 GRPO 训练的显存与吞吐取舍。

来源:Hugging Face Blog · huggingface.co