BBYR Achieve
返回信息流
这是一条镜像帖。来源:北邮人论坛 / job-info / #971162同步于 2025/1/6
该镜像源已超过 30 天没有更新,可能在源站已被删除。
JobInfo机器人发帖

【社招】【知名大模型公司】多模态算法,数字人算法,大模型对

DLL641388166
2025/1/6镜像同步0 回复
微信:18518019493 邮箱:641388166@qq.com 多模态算法--视觉 职位描述 作为多模态算法工程师 - 视觉方向,您将负责推动视觉理解模型或视觉生成模型的算法研发工作。您的工作将涵盖以下几个方面: 1、探索前沿的数据策略, 建模方式等,以达到SOTA的视觉模型效果 2、探索更高效的 Scaling 数据与模型的方法,以在更高算力下延续 Scaling Law 3、进行算法 - 系统的 co-design, 优化算法效率 4、建立高效,自动化的数据系统,评测系统,进行大规模数据处理和分析 职位要求 1、有扎实的编程基础,对数据结构、算法设计有深度了解,熟练掌握 Pythnon,熟练应用一种深度学习框架并熟悉其底层原理。 2、熟悉计算机视觉领域的常见工具与算法。 3、对多模态大模型/扩散模型等相关模型有深入理解,能跟踪语言模型和多模态领域的最新技术动向。 4、具备强大的工程能力,能迅速迁移过往的工程经验,深入理解系统底层原理并进行系统优化,能快速学习新知识。 5、责任心强,积极主动,有良好的沟通和合作能力。 多模态算法--图文方向 职位描述 1. 探索多模态预训练环节更高效的Data和Modeling方法,使得当算力提升时,我们依然可以延续Scaling Law。用尽世界上的所有多模态数据。探索并实现更多更好的数据发现、清洗和生成策略。 2. 深入参与设计科学的MLLM实验,构建对MLLM经济有效的训练数据recipe,探索数据配比、模型scaling相关的前沿技术,深入参与并了解如何训练好一个MLLM基座模型。 3. 构建能够支撑PB级别数据量的基础平台和工具。具备极佳的工程实现能力和数据处理能力。 职位要求 1. 本科及以上学历,计算机、人工智能、自动化、数学专业优先 2. 具备强大的工程能力,能迅速迁移过往的工程经验,深入理解系统底层原理并进行系统优化,能快速学习新知识。 3. 对大模型的底层原理有基本理解,并能跟踪语言模型和多模态领域的最新技术动向。 4. 扎实的编程基础,对数据结构、算法设计基础有深度了解,熟练掌握Python/C++等主流语言一种或多种,熟练应用pytorch、tensorflow、huggingface等深度学习框架和库 5. 有ACM/IOI/NOI/Top Coder等算法竞赛获奖经历优先 6. 深入理解CV、NLP等机器学习领域的知识,拥有MLLM预训练、后训练和对齐等丰富实操经验,或MLLM数据筛选和优化相关经验优先 7. 熟悉Spark, Ray等分布式计算框架优先 8. 在顶级学术会议上发表论文者优先,在机器学习、人工智能领域内获得过优异成绩者优先 9. 责任心强,积极主动,有良好的沟通和合作能力 多模态算法--音频 职位描述 1. 从事语音、音效、音乐等音频类算法的设计、优化和高效训练,达到SOTA的音频大模型效果; 2. 参与音频大模型的系统构建和开发,探索数据/模型scaling相关的前沿技术; 3. 参与构建高效的数据处理平台工具,进行大规模数据处理和分析; 4. 探索通用的音频多模态建模技术,探索前沿技术,解决业界实际问题。 职位要求 1. 本科及以上学历,计算机科学、人工智能、自动化、数学、物理等相关专业优先; 2. 有语音合成与识别、音频生成、音乐生成、自然语言处理等研究或者技术背景者优先; 3. 拥有大模型训练和优化经验者优先,包括LLM、TTS/ASR大模型、音频理解大模型、音乐生成大模型等; 4. 深刻理解各类生成式模型者优先,比如自回归、GAN、VAE、Flow、Diffusion/flow-matching等; 5. 掌握音频处理流程的各个模块,包括语音合成前端,语音增强,语音识别,说话人日志(diarization), 强制对齐(force alignment) ,并有相关模块训练和推理经验; 6. 具备扎实的编程基础,熟练掌握Python/C++等主流语言一种或多种,熟练应用pytorch、tensorflow、huggingface等深度学习框架和库; 7. 发表过领域顶级会议文章(NeurIPS、ICML、ICLR、ACL、Interspeech、ICASSP等)、相关实习经验或者ACM竞赛获奖者优先; 8. 具备良好的学习能力、逻辑思维能力和沟通协作能力,积极主动,责任心强。 数字人算法 职位描述 从事数字人/虚拟人/人脸视频生成算法研发工作,包括但不限于: 1. 探索高表现力/低延迟的语音驱动的说话人脸视频生成方案; 2. 探索多角度/大动作的全身人体生成; 3. 探索前沿的建模方式、训练策略、数据策略等,以达到SOTA的视频生成效果; 4. 探索AI能力的极限,并赋能产品以创造价值。 职位要求 1. 本科及以上学历,计算机、人工智能、自动化、数学专业优先; 2. 对大模型的底层原理有基本理解,能跟踪语言模型和多模态领域的最新技术动向; 3. 扎实的编程基础,对数据结构、算法设计基础有深度了解,熟练掌握Python/C++等主流语言一种或多种,熟练应用pytorch、tensorflow、huggingface等深度学习框架和库; 4. 具备强大的工程/算法能力,能迅速迁移过往的工程/算法经验,深入理解系统底层原理并进行系统优化,能快速学习新知识; 5. 有ACM/IOI/NOI/Top Coder等算法竞赛获奖经历优先; 6. 深入理解CV、NLP等机器学习领域的知识,拥有图像/视频生成或AIGC领域丰富实操经验,以及人脸人体3D建模相关经验优先; 7. 在顶级学术会议上发表论文者优先,在机器学习、人工智能领域内获得过优异成绩者优先; 8. 责任心强,积极主动,有良好的沟通和合作能力。 大模型对齐研发 职位描述 1. 参与开发大模型对齐算法开发、数据构造,提升大模型在应用场景的效果 2. 与 Kimi 产品、Kimi 开放平台等团队合作,实现大模型实际应用中需要的功能点 3. 评估并跟踪大模型在实际应用中的表现,通过优化模型性能,提升产品的用户满意度 职位要求 1. 985/211?校研究?以上学历或优秀本科?,计算机科学、??智能、机器学习等相关专业; 2. 具备良好的团队协作能?和沟通能?; 3. 具备扎实的编程基础,有优秀的?程能?,包括机器学习、python 编程、各类深度学习框架等; 4. 有?语言模型相关产品和算法开发经验,有较强的 Problem Solving 能力; 5. 熟悉大模型相关研究的前沿进展,能快速复现业界最新研究成果,有顶会论文、ACM等编程竞赛获奖者优先。 全栈开发 职位描述 1. 设计和开发内部研发效率工具,以提高产研团队的工作效率。包括不限于研发效能工具、数据分析系统等 2. 深入理解 Kimi 产品研发和大模型算法迭代的全流程,开发工具或系统,以 定义、量化并优化迭代效率 3. 独立完成系统的规划、研发和维护工作 职位要求 1. 对提高效率有热情,有使用和开发此类工具的经验;对代码质量有高要求者优先 2. 本科及以上学历,计算机科学或相关专业(非计算机专业但编程能力突出者亦可) 3. 三年以上的全栈开发经验,有实际的 Web 应用开发项目经验,有开源项目的维护经历者优先 4. 熟悉 Python 和 Golang 语言,对于 MySQL、ES、Redis、Kafka 等有使用经验 5. 良好的逻辑思维能力和问题解决能力。良好的沟通能力和团队合作精神。对新技术有强烈的好奇心和快速学习的能力。
订阅后,新回复会通过你的通知中心匿名送达。
0 条回复
暂无回复 · 你可以订阅本帖等待新回复。