/playground)用于短时试用模型。服务带 TTL,到期自动回收;需要稳定端点、Token、自愈和 Revision 的场景请使用模型部署。
Playground:从训练导出或 HF id 拉起 vLLM 服务。
启动服务
- 选择模型:训练产物下拉(有 hf_export 的 run)或直接输入 HF id / 共享盘路径;
- 选卡数(= 张量并行度)与 TTL;
- 启动。状态卡实时显示:拉起中 → 就绪 → 剩余 TTL。
聊天
- 流式输出、可调 system prompt / temperature / max tokens;
- 会话历史留在本页(刷新即清,不入库)。
A/B 对比
选两个就绪的服务并排:同一输入同时发送,输出并列渲染——SFT vs GRPO、v1 vs v2 的对齐差异直接肉眼可感。管理
页面列出我的全部服务:端点地址、占卡、剩余 TTL、续期 / 停止按钮。TTL 到期自动回收(防「起了忘了关」)。Playground 为可配置功能,管理员可按角色开放;slurm 后端暂不支持(训练节点通常无入向网络)。语义详见 Playground 指南。