本地模型部署增加选择容器绑定到哪张显卡

多卡环境部署模型默认count: all,用多个容器部署多个模型得手动改compose,虽说不是做不到手动改绑,但毕竟vLLM都收费了,也不是一个很难的功能,麻烦了