一直阻塞在这个命令段 后面,换成一张卡跑一个模型,就可以了,请问之前的那个状态要如何解决 模型用的是这个 qwen36b_35b_w8a8z
(APIServer pid=1) INF0:172.17.0.1:56762 - "GET /v1/models HTTP/1.1" 200 0Kroot@localhost ~]# time curl -s http://localhost:19002/v1/embeddings -H "Content-Type: application/json"\'{"model":"qwen3-embedding","input":["测试文本"]}'