论坛首页
沐曦开发者
search
menu
Sign in
已解决
label
产品&运维
label
已解决
双机部署模型运行一段时间后ray报错
chat_bubble_outline
6
2026年7月31日
求助:metax C550上使用vllm部署Qwen3.5-122B-A10B-W8A8模型的deepep功能报错
chat_bubble_outline
15
2026年7月31日
如何将cuda代码.cu编译成MACA可执行文件
chat_bubble_outline
1
2026年7月31日
DeepSeek-V4-Flash 量化部署失败
chat_bubble_outline
4
2026年7月29日
k8s 1.20.2 已经安装metax-operator,都正常运行,但是pod里面vllm单卡可以运行,多卡运行报错
chat_bubble_outline
11
2026年7月23日
3.8版本的驱动包依赖的3.9版本的rpm包造成驱动安装失败
chat_bubble_outline
2
2026年7月23日
Step-3.7-Flash-W8A8部署问题
chat_bubble_outline
1
2026年7月23日
6月30日发布的vllm 0.21.0是否支持deepseek v4部署?如果支持,正确的启动命令是?
chat_bubble_outline
20
2026年7月21日
C500, 单卡,可以跑Qwen3.6的哪个量化版本?
chat_bubble_outline
10
2026年7月20日
LM Cache
chat_bubble_outline
7
2026年7月20日
曦云C550和昇腾910B3能做硬件异构PD分离吗
chat_bubble_outline
8
2026年7月20日
在沐曦c500上配好环境后,跑torch.cuda的相关指令,程序就返回killed
chat_bubble_outline
1
2026年7月20日
C500是否支持GPU-initiated 通信
chat_bubble_outline
1
2026年7月20日
k8s container runtime运行报错
chat_bubble_outline
3
2026年7月17日
sglang 多卡并行启动大模型服务不管模型大小多小都报内存溢出
chat_bubble_outline
15
2026年7月17日
沐曦C500 卡使用最新版本的SDK3.7.1版本容器镜像无论是sglang还是vllm 引擎启动大模型都非常吃内存
chat_bubble_outline
1
2026年7月17日
请问 曦思N100驱动和压测工具包哪里能下载到
chat_bubble_outline
1
2026年7月17日
沐曦 MXC500 是否支持 W4A8 量化部署
chat_bubble_outline
1
2026年7月17日
镜像资源“离线包下载”&“离线包wget命令复制”为什么部分镜像没有
chat_bubble_outline
1
2026年7月13日
当前有支持投机解码的镜像吗,
chat_bubble_outline
1
2026年7月13日
HiCache JIT kernel 编译失败
chat_bubble_outline
1
2026年7月13日
glm5.1 PD分离问题
chat_bubble_outline
14
2026年7月13日
沐曦SGLang 加载 JIT HiCache kernel Failed !!!
chat_bubble_outline
4
2026年7月13日
下载官方镜像报错
chat_bubble_outline
12
2026年7月13日
请问8卡C600能否正常部署GLM5.2或者deepseek V4 pro的量化版本
chat_bubble_outline
1
2026年7月13日
申请DeepSeek-V4-Flash-FlexSMQ-AWQ-W8A8镜像
chat_bubble_outline
1
2026年7月13日
first_page
chevron_left
页码
跳转
chevron_right
last_page