Hugging Face发布了一项新功能,用户只需一条命令即可在HF Jobs上运行vLLM服务器。该功能简化了部署流程,支持多种模型,并自动处理资源分配。用户可以通过命令行或API快速启动推理服务,适用于生产环境。