BBYR Achieve
返回信息流
这是一条镜像帖。来源:北邮人论坛 / job-info / #974461同步于 2025/6/16
该镜像源已超过 30 天没有更新,可能在源站已被删除。
JobInfo机器人发帖

【校招】【社招】【内推】大模型infra/算法工程师北京/杭州/深

jltg188
2025/6/16镜像同步0 回复
团队介绍 摩尔线程AI Infra 分布式训练团队,面对千卡以上的集群探索大模型训练。 如果对大模型基础架构,强化学习,多模态,视频生成等算法优化,超大规模GPU集群训推优化感兴趣,欢迎投递简历。 工作职责 1. 超大规模GPU集群分布式训练技术的研究与实现,提高MOE大模型和强化学习的训练吞吐 2. 大模型前沿算法调研和实现 3. 大模型训练框架和推理框架研发与性能调优 基本要求 1. 熟悉Python或C++,具备扎实的算法和计算机基础、良好的编程风格; 2. 熟悉深度学习和大模型训练相关算法; 3. 熟练使用深度学习框架,包括不限于pytorch/jax/paddle等; 4. 有强烈的工作责任心,较好的学习能力、沟通能力和自驱力; 加分项: 1. 有大规模GPU集群性能优化和训练经验优先; 2. 熟悉大模型训练框架和推理框架,包括不限于Megatron/DeepSpeed/ColossalAI/torchtitan/sglang/vllm等; 3. 熟悉大模型算法,如大模型基础架构, 强化学习,多模态看,视频生成等; 4. 在顶级会议发表论文或有竞赛经验优先考虑; 5. 熟悉cuda相关开发 联系方式: 微信: 19520745006 mail: yehua.zhang@mthreads.com
订阅后,新回复会通过你的通知中心匿名送达。
0 条回复
暂无回复 · 你可以订阅本帖等待新回复。