BBYR Achieve
返回信息流
这是一条镜像帖。来源:北邮人论坛 / parttime-job / #983382同步于 2026/1/26
该镜像源已超过 30 天没有更新,可能在源站已被删除。
ParttimeJob机器人发帖

【实习】搜狐智能媒体研发中心AI infra实习生

y3297573343
2026/1/26镜像同步0 回复
实习:北京搜狐智能媒体研发中心——高性能计算——AI Infra方向 岗位职责: 1.参与深度学习 / 大模型推理加速相关算法的研究与实现,包括但不限于模型量化、剪枝、蒸馏、压缩等方向,在指导下完成部分模块的设计与优化。 2.参与 LLM / 多模态模型的推理部署与性能优化工作,协助进行端到端推理流程的调优与实验验证。 3.协助调研和使用主流大模型推理加速框架(如 vLLM、SGLang、TRT-LLM 等),参与相关性能测试、对比分析与工程实践。 4.参与 AI 端到端任务流程或系统组件的开发,支持大模型在实际业务场景中的高效运行。 5.参与计算集群或算力资源相关的基础优化工作,完成性能分析、问题定位与实验验证。 6.编写技术文档与实验报告,总结优化经验,推动技术方案沉淀。 岗位要求: 1.计算机科学、电子信息、自动化、数学、人工智能等相关专业在读本科或硕士研究生。 2.具备扎实的编程基础,熟悉 Python / C++ 中至少一门语言,有良好的代码习惯。 3.熟悉主流深度学习框架(如 PyTorch / TensorFlow),了解深度学习模型的基本训练与推理流程。 4.对高性能计算、模型推理加速或系统优化 方向有浓厚兴趣,了解或使用过模型量化、剪枝、算子优化等技术者优先。 5.了解 CPU / GPU 基本架构原理,有 CUDA、Triton 或相关并行计算经验者优先。 6.学习能力强,具备良好的问题分析与沟通能力,对新技术保持敏感和热情。 实习要求: 1.实习时间:每周不少于 4 天 2.实习周期:3 个月及以上(长期实习者优先) 加分项(非必须): 1.使用或研究过大模型推理框架(vLLM / TRT-LLM / FasterTransformer 等),对开源项目有过贡献 2.有模型压缩、推理优化或系统性能调优相关项目/竞赛经验 3.对 AI 系统、分布式计算、算力调度方向有深入兴趣
订阅后,新回复会通过你的通知中心匿名送达。
0 条回复
暂无回复 · 你可以订阅本帖等待新回复。