我们5.8和5.30都在沐曦股份公众号、开发者社区动态页面、沐曦股份小红书等多个官方渠道发布过赛事信息啦,这次在论坛同步信息是提供大家一个更公开的讨论赛事的平台。不过您的建议确实有帮助,我们之后如果有相关赛事活动的话,也会在论坛页面再次同步一遍信息,感谢您的建议~
我们5.8和5.30都在沐曦股份公众号、开发者社区动态页面、沐曦股份小红书等多个官方渠道发布过赛事信息啦,这次在论坛同步信息是提供大家一个更公开的讨论赛事的平台。不过您的建议确实有帮助,我们之后如果有相关赛事活动的话,也会在论坛页面再次同步一遍信息,感谢您的建议~
2026 年度中国青年科技创新「揭榜挂帅」擂台赛正式启幕。沐曦股份重磅发布两大 AI 算力硬核榜题,聚焦国产 GPU 大模型推理算子优化,以硬核赛事搭建科研攻关平台,邀全国青年学子、科研人才揭榜攻坚,用技术重构推理效率,用创新拉低每 Token 算力成本!
两大重磅赛题 直击推理成本核心痛点
赛题一:基于国产软件栈大模型推理前沿算子优化
当前主流大模型底层代码深度绑定海外生态,国产算力缺少自主可控的核心算子库,成为成本优化与产业安全的双重短板。
本赛题依托国产开源 TileLang语言 + 沐曦 MXMACA 全栈软件栈 + 曦云 C500 算力,聚焦三大业界前沿高价值算子攻坚:
🔹 Fused Moe Gemm:优化 MoE 模型稀疏计算,提升算力利用率
🔹 MLA(Multi-Head Latent Attention):适配 DeepSeek V3,压缩 KV Cache 显存,破解长序列成本瓶颈
🔹 NSA(Native Sparse Attention):实现超长文本推理加速,显存节省超 50%
初赛攻坚 Fused Moe Gemm、决赛冲刺 MLA/NSA,全程基于全国产技术栈开发优化,打造自主可控的低成本大模型推理算子底座。
赛题二:基于 AI Agent 开发范式的国产 GPU 大模型推理算子库优化
大模型推理具有高并发、长序列、高调用频次等特点,FlashInfer、FlashAttention、Fused MoE 等核心算子直接决定模型服务的吞吐、延迟与显存开销,影响单 Token 综合推理成本。
本赛题面向沐曦国产 GPU 及 MXMACA 软件栈,鼓励参赛团队构建或使用 AI Agent / Skill 工作流,围绕推理算子库开展代码理解、算子迁移、性能分析、Kernel 优化、自动调优、Benchmark 验证和多轮迭代,探索“Agent 驱动算子优化”的新型开发范式。
参赛作品应体现 AI Agent 在底层算子优化过程中的实际参与能力,而不是仅停留在概念说明、文档生成或简单代码补全层面。参赛团队需要理解大模型推理算子库的计算逻辑、国产 GPU / MXMACA 软件栈的开发方法,以及 AI Agent / Skill 优化工作流,在保证正确性、稳定性和可复现性的前提下,提升相关算子或端到端推理链路在国产 GPU 上的执行性能。
参赛团队可围绕以下推理算子库或核心算子,选择一类或多类任务开展优化工作:
FlashInfer 关键算子迁移与优化:面向 Prefill、Decode、Paged KV Cache、MLA Attention 等推理场景,完成 MACA 平台适配与性能优化;
FlashAttention 关键算子迁移与优化:围绕 flash_attn_with_kvcache 等核心接口,提升长序列场景下的 Attention 计算性能;
MCTLASS / Fused MoE 算子优化:聚焦 MoE 模型中的稀疏专家计算,优化 Fused MoE 算子的执行效率;
最终成果应包括可复现的源码、测试框架、性能测试脚本、性能报告、Agent / Skill 工作流,以及对应的文档和展示材料。评审将重点考察性能提升效果、Agent / Skill 工作流的可复现性,以及文档说明与演示报告的完整性。
两个赛题统一使用模力方舟上的镜像PyTorch-Agent / 2.8.0 / Python 3.12 / maca 3.7.2.1
参赛对象
面向全国全日制专科、本科、硕博在校生(非在职),40 周岁以下青年科技人才均可参与;
可个人 / 团队组队(团队≤10 人),跨专业、跨校、跨地域自由组队,最多 3 名指导老师带队。
丰厚赛事激励
现金奖金激励
擂主 10 万元、特等奖 2 万元、一等奖 1 万元、二等奖 0.5 万元、三等奖 0.2 万元
硬件福利加码
擂主直得 2 张沐曦高端 GPU 加速卡、特等奖专属 GPU 加速卡
成长专属权益
优秀获奖者直通沐曦 & 之江联合培养计划、赛事官方荣誉证书
生态曝光扶持
优秀作品入驻沐曦开发者社区 & 启悟学习社区,成果孵化 + 产业落地全方位赋能
全程赛事保障 助力全力攻坚
提供曦云 C500 在线算力资源券,无需自备硬件
线上专项技术培训 + 回放文档,零基础也能快速上手
沐曦股份资深技术专家社群常驻答疑,定期解惑攻关难题
官方提供技术文档、算子基线样例、标准测试集与评测脚本
关键时间节点
5.30-6.30 赛事报名
5-9 月 课题攻关
9月初审
10-11月 终审擂台赛
算力获取和使用
沐曦开发者社区活动页面,完成新人礼任务,提前熟悉 C500 在线算力使用。developer.metax-tech.com/activities/6
学生可通过登录启悟社区后跳转沐曦开发者社区领取100元算力代金券。developer.metax-tech.com/activities/11
报名赛事后还可额外获得300元算力代金券:developer.metax-tech.com/activities/17
青年挺膺担当,科创筑梦算力!
加入沐曦股份“揭榜挂帅”赛题,深耕国产 GPU 算子优化,用技术降低每 Token 推理成本,共建自主可控 AI 算力新生态!
比赛仓库地址:www.gitlink.org.cn/metax-maca/op_optimization
👇 报名通道:2026.tiaozhanbei.net/
请问您提交的是基础任务还是打榜赛任务,您可以把具体问题以邮件的形式发送至邮箱opensource@metax-tech.com ,我们安排尽快解答。
各位沐曦开发者、挑战赛参赛伙伴们,大家好!👋
沐曦股份 × 魔搭社区|开源实战挑战赛第一期正在火热进行中,非常感谢大家的积极参与和支持!
无论是刚上手的新手伙伴,还是进阶冲榜的技术达人,在实操过程中难免会遇到各类问题——可能是Swift镜像使用、沐曦单卡环境配置的小困扰,环境变量设置的疑问,也可能是基础任务提交、进阶任务(checkpoint/评测文件夹)准备的相关困惑,甚至是对赛事规则、课程学习的相关疑问,都可以在这里畅所欲言!
温馨提示:留言时可以简要说明自己遇到的问题场景(如基础任务/进阶任务、具体操作步骤),方便大家更精准地帮你解答哦~
尊敬的开发者您好,这是我们3/20新书发布的一次福利活动。若您想获得《MXMACA C/C++程序设计入门教程》,您可上京东平台购买书籍,感谢您的支持!
尊敬的开发者,感谢您在小红书发布晒单内容,请您在活动页面去申请算力券哦,我们尽快为您发放~
尊敬的开发者您好,NVIDIA 的软件最终用户许可协议(EULA)第1.2章第8条中限制对SDK的输出进行反向工程、反编译、反汇编以适配到非NVIDIA平台上的行为,沐曦软硬件产品亦无直接兼容PTX的功能。如您明确要实现的具体功能,请到developer.metax-tech.com/doc中搜索开发文档中是否有相应的builtin函数,https://developer.metax-tech.com/api/client/document/preview/977/split_files/c_%E8%AF%AD%E8%A8%80%E6%89%A9%E5%B1%95.html#8btcc8cj98yn1
随着国产算力硬件迈入迭代加速的快车道,构建蓬勃的开发者生态已成为推动产业高质量发展升级的关键引擎。为了连接产业实战需求与人才培养,为开发者提供真机实操的沃土,沐曦股份携手模力方舟正式发布 AI 技能认证体系。
*破解矛盾*
当前,行业面临两大痛点:
一方面,高校 AI 课程与产业实际需求之间连接不够紧密,开发者缺少国产 GPU 的真机实操机会,企业也很难找到具备国产算力部署能力的技术人才。
另一方面,市场缺乏统一、权威的技能评估标准,企业招聘无凭可依,开发者求职无证可凭。
本次推出的 AI 技能认证体系,将以权威标准重塑人才评价坐标,让国产算力生态真正“软硬协同,人才辈出”。
*AI 技能认证能带来什么*
官方权威背书:证书由沐曦股份与模力方舟联合签发并加盖公章,支持在线核验,是国产算力与信创生态的官方能力证明。
实操技能提升:认证全程基于沐曦股份真实 GPU 云端算力环境,考核任务覆盖从环境搭建到多模态模型部署的完整链路,所有技能直接对应实际开发场景。
就业竞争力:认证通过的开发者将进入国产 GPU 与信创企业人才储备库,在求职、合作、项目申报中获得优先推荐。
社群与技术支持:加入开发者社群,获得专家一对一指导,以及国产 GPU 算力市场的免费测试时长。
从适配到优化:三级认证覆盖完整能力栈
初级 L1「模型部署与应用入门」,面向在校学生和初级开发者,核心内容为国产算力的开发环境搭建、模型部署与迁移,当前已开放报名。
中级 L2「算力开发入门」,面向在校学生和中级开发者,覆盖算子编程与算子编译方向,将在后续推出。
高级 L3「算力优化专家」,面向高级开发者,覆盖算子适配与算子加速方向,将在后续推出。
初级认证:五大场景全实操考核
以初级认证为例,认证采用全实操考核,共 7 项任务。学员需要在模力方舟平台上使用国产 GPU 云端算力,从芯片环境熟悉开始,逐步完成文本生成、图像生成、语音识别与合成、OCR、向量检索等模型的部署。完成全部考核,即具备在国产 GPU 环境下独立部署主流 AI 应用的基本能力。
双方盖章,链上可查
证书由沐曦股份与模力方舟联合签发并加盖双方公章。每张证书配有独立防伪二维码,支持区块链链上核验。通过认证的开发者同时获得电子证书和纸质证书,电子证书可在线分享并添加至简历,证书编号支持在模力方舟官网在线查询。
*现在就可以开始*
进入模力方舟官网「技能认证专区」,点击「开始认证」,选择目标认证的芯片方向。
通过平台提供的课程系统学习沐曦股份算力开发环境和相关工具链。
提交成果,经系统自动初审与专家人工复审后获得证书。
从第一次环境搭建,到第一次模型部署,
加入沐曦开发者生态,成为国产算力技术落地的实践者与推动者。
*认证专区:moark.com/certification
为帮助开发者更系统地学习沐曦MXMACA 编程与国产算力平台开发技术,沐曦正式发布《MXMACA C/C++程序设计高级教程》。该书与《MXMACA C/C++程序设计入门教程》共同构成完整的学习体系,帮助开发者从基础入门逐步进阶到高级开发实践。
本次新书发布活动特别为开发者准备了现场福利与社区奖励,欢迎参与。
活动现场签到,并扫码加入沐曦开发者微信群,即可领取:
《MXMACA C/C++程序设计入门教程》
该书为《MXMACA C/C++程序设计高级教程》的配套入门教材。
完成全部参与步骤的开发者,可额外获得:
100 元算力代金券
活动现场签到,并扫码加入沐曦开发者微信群,即可领取:
《MXMACA C/C++程序设计入门教程》。
在以下任意平台发布新书照片或阅读心得:
- 小红书
- 抖音
- 微博
发布内容需带话题:
#沐曦 、 #开源 、 #沐曦MXMACA 、#沐曦开发者社区 、#开源企业中心
扫描活动二维码,注册沐曦开发者社区账号。
将社交平台发布截图,评论提交至本论坛活动帖:
《MXMACA C/C++程序设计高级教程》新书发布福利活动
社区后台审核通过后,即可获得:
100 元算力代金券
⚠️ 算力券将在 7 个工作日内发放。
在审核期间,请勿删除社交平台发布内容,否则可能影响奖励发放。
- 本活动最终解释权归沐曦开发者社区所有。