Hugging Face Blog·· 2025-06-03精选AI 评分62
TRL 支持 vLLM 与 GRPO 训练同卡共置
No GPU left behind: Unlocking Efficiency with Co-located vLLM in TRL
AI 导读
TRL 通过 PR #3394 支持 vLLM 的 external launcher,让推理与 GRPO 训练在同一批 GPU 上共置运行,不再需要单独的 vLLM 服务器进程。
推荐理由
TRL 把 vLLM 从独立推理服务改为与训练同卡共置,读者可据此判断 GRPO 训练的显存与吞吐取舍。
来源:Hugging Face Blog · huggingface.co