BBYR Achieve
返回信息流
这是一条镜像帖。来源:北邮人论坛 / job-info / #978068同步于 2026/1/7
该镜像源已超过 30 天没有更新,可能在源站已被删除。
JobInfo机器人发帖

【实习】腾讯wxg搜索大模型算法日常实习生招聘,27届及以后

guan1225
2026/1/7镜像同步0 回复
【团队介绍】 腾讯微信搜索语义技术团队隶属于微信事业群搜索应用部,专注于多模态大模型的预训练、SFT/RL对齐、多模态内容理解与表征等前沿技术研究,支撑微信“搜一搜”与“视频号”等亿级用户场景下的搜索需求。 【工作职责】 - 负责视频搜索全链路的算法优化,涵盖召回、精排、混排、相关性建模及用户体验等核心环节; - 深入探索基于强化学习(RL)的搜索与推荐前沿技术,包括但不限于: - 设计并实现 Agent 驱动的复杂查询的动态任务拆解、工具调用与策略反思; - 研究 RL 与 RAG、排序模型、多模态对齐的融合机制,提升搜索结果的准确性、多样性与用户满意度; - 将 RL 与大模型能力深度结合,推动在线策略迭代、离线 reward 建模、DPO/RLHF 等技术在真实业务场景中的落地。 【任职要求】 - 熟悉深度学习、强化学习、机器学习基础理论,对 **RL 算法(如 PPO、DPO、GRPO 等)** 有扎实理解和实践经验; - 对 Agent 架构、SFT、Chain-of-Thought 等方向有浓厚兴趣或项目经验; - 具备优秀的编程实现能力(Python/PyTorch 为主),熟悉分布式训练、模型压缩与线上部署流程; - 良好的沟通协作能力与技术热情,能快速跟进领域前沿进展; **加分项**: - 在 NeurIPS、ICML、ICLR、KDD、WWW、ACL、CVPR 等顶会发表 RL、Agent 或搜索相关论文; - 有大模型 + RL 实际项目经验(如 reward modeling、策略微调); - ACM/ICPC、Kaggle、天池等算法竞赛获奖经历。 简历投递方式: 656438790@qq.com
订阅后,新回复会通过你的通知中心匿名送达。
0 条回复
暂无回复 · 你可以订阅本帖等待新回复。