返回信息流微信:18518019493
邮箱:641388166@qq.com
多模态算法--视觉
职位描述
作为多模态算法工程师 - 视觉方向,您将负责推动视觉理解模型或视觉生成模型的算法研发工作。您的工作将涵盖以下几个方面:
1、探索前沿的数据策略, 建模方式等,以达到SOTA的视觉模型效果
2、探索更高效的 Scaling 数据与模型的方法,以在更高算力下延续 Scaling Law
3、进行算法 - 系统的 co-design, 优化算法效率
4、建立高效,自动化的数据系统,评测系统,进行大规模数据处理和分析
职位要求
1、有扎实的编程基础,对数据结构、算法设计有深度了解,熟练掌握 Pythnon,熟练应用一种深度学习框架并熟悉其底层原理。
2、熟悉计算机视觉领域的常见工具与算法。
3、对多模态大模型/扩散模型等相关模型有深入理解,能跟踪语言模型和多模态领域的最新技术动向。
4、具备强大的工程能力,能迅速迁移过往的工程经验,深入理解系统底层原理并进行系统优化,能快速学习新知识。
5、责任心强,积极主动,有良好的沟通和合作能力。
多模态算法--图文方向
职位描述
1. 探索多模态预训练环节更高效的Data和Modeling方法,使得当算力提升时,我们依然可以延续Scaling Law。用尽世界上的所有多模态数据。探索并实现更多更好的数据发现、清洗和生成策略。
2. 深入参与设计科学的MLLM实验,构建对MLLM经济有效的训练数据recipe,探索数据配比、模型scaling相关的前沿技术,深入参与并了解如何训练好一个MLLM基座模型。
3. 构建能够支撑PB级别数据量的基础平台和工具。具备极佳的工程实现能力和数据处理能力。
职位要求
1. 本科及以上学历,计算机、人工智能、自动化、数学专业优先
2. 具备强大的工程能力,能迅速迁移过往的工程经验,深入理解系统底层原理并进行系统优化,能快速学习新知识。
3. 对大模型的底层原理有基本理解,并能跟踪语言模型和多模态领域的最新技术动向。
4. 扎实的编程基础,对数据结构、算法设计基础有深度了解,熟练掌握Python/C++等主流语言一种或多种,熟练应用pytorch、tensorflow、huggingface等深度学习框架和库
5. 有ACM/IOI/NOI/Top Coder等算法竞赛获奖经历优先
6. 深入理解CV、NLP等机器学习领域的知识,拥有MLLM预训练、后训练和对齐等丰富实操经验,或MLLM数据筛选和优化相关经验优先
7. 熟悉Spark, Ray等分布式计算框架优先
8. 在顶级学术会议上发表论文者优先,在机器学习、人工智能领域内获得过优异成绩者优先
9. 责任心强,积极主动,有良好的沟通和合作能力
多模态算法--音频
职位描述
1. 从事语音、音效、音乐等音频类算法的设计、优化和高效训练,达到SOTA的音频大模型效果;
2. 参与音频大模型的系统构建和开发,探索数据/模型scaling相关的前沿技术;
3. 参与构建高效的数据处理平台工具,进行大规模数据处理和分析;
4. 探索通用的音频多模态建模技术,探索前沿技术,解决业界实际问题。
职位要求
1. 本科及以上学历,计算机科学、人工智能、自动化、数学、物理等相关专业优先;
2. 有语音合成与识别、音频生成、音乐生成、自然语言处理等研究或者技术背景者优先;
3. 拥有大模型训练和优化经验者优先,包括LLM、TTS/ASR大模型、音频理解大模型、音乐生成大模型等;
4. 深刻理解各类生成式模型者优先,比如自回归、GAN、VAE、Flow、Diffusion/flow-matching等;
5. 掌握音频处理流程的各个模块,包括语音合成前端,语音增强,语音识别,说话人日志(diarization), 强制对齐(force alignment) ,并有相关模块训练和推理经验;
6. 具备扎实的编程基础,熟练掌握Python/C++等主流语言一种或多种,熟练应用pytorch、tensorflow、huggingface等深度学习框架和库;
7. 发表过领域顶级会议文章(NeurIPS、ICML、ICLR、ACL、Interspeech、ICASSP等)、相关实习经验或者ACM竞赛获奖者优先;
8. 具备良好的学习能力、逻辑思维能力和沟通协作能力,积极主动,责任心强。
数字人算法
职位描述
从事数字人/虚拟人/人脸视频生成算法研发工作,包括但不限于:
1. 探索高表现力/低延迟的语音驱动的说话人脸视频生成方案;
2. 探索多角度/大动作的全身人体生成;
3. 探索前沿的建模方式、训练策略、数据策略等,以达到SOTA的视频生成效果;
4. 探索AI能力的极限,并赋能产品以创造价值。
职位要求
1. 本科及以上学历,计算机、人工智能、自动化、数学专业优先;
2. 对大模型的底层原理有基本理解,能跟踪语言模型和多模态领域的最新技术动向;
3. 扎实的编程基础,对数据结构、算法设计基础有深度了解,熟练掌握Python/C++等主流语言一种或多种,熟练应用pytorch、tensorflow、huggingface等深度学习框架和库;
4. 具备强大的工程/算法能力,能迅速迁移过往的工程/算法经验,深入理解系统底层原理并进行系统优化,能快速学习新知识;
5. 有ACM/IOI/NOI/Top Coder等算法竞赛获奖经历优先;
6. 深入理解CV、NLP等机器学习领域的知识,拥有图像/视频生成或AIGC领域丰富实操经验,以及人脸人体3D建模相关经验优先;
7. 在顶级学术会议上发表论文者优先,在机器学习、人工智能领域内获得过优异成绩者优先;
8. 责任心强,积极主动,有良好的沟通和合作能力。
大模型对齐研发
职位描述
1. 参与开发大模型对齐算法开发、数据构造,提升大模型在应用场景的效果
2. 与 Kimi 产品、Kimi 开放平台等团队合作,实现大模型实际应用中需要的功能点
3. 评估并跟踪大模型在实际应用中的表现,通过优化模型性能,提升产品的用户满意度
职位要求
1. 985/211?校研究?以上学历或优秀本科?,计算机科学、??智能、机器学习等相关专业;
2. 具备良好的团队协作能?和沟通能?;
3. 具备扎实的编程基础,有优秀的?程能?,包括机器学习、python 编程、各类深度学习框架等;
4. 有?语言模型相关产品和算法开发经验,有较强的 Problem Solving 能力;
5. 熟悉大模型相关研究的前沿进展,能快速复现业界最新研究成果,有顶会论文、ACM等编程竞赛获奖者优先。
全栈开发
职位描述
1. 设计和开发内部研发效率工具,以提高产研团队的工作效率。包括不限于研发效能工具、数据分析系统等
2. 深入理解 Kimi 产品研发和大模型算法迭代的全流程,开发工具或系统,以 定义、量化并优化迭代效率
3. 独立完成系统的规划、研发和维护工作
职位要求
1. 对提高效率有热情,有使用和开发此类工具的经验;对代码质量有高要求者优先
2. 本科及以上学历,计算机科学或相关专业(非计算机专业但编程能力突出者亦可)
3. 三年以上的全栈开发经验,有实际的 Web 应用开发项目经验,有开源项目的维护经历者优先
4. 熟悉 Python 和 Golang 语言,对于 MySQL、ES、Redis、Kafka 等有使用经验
5. 良好的逻辑思维能力和问题解决能力。良好的沟通能力和团队合作精神。对新技术有强烈的好奇心和快速学习的能力。
这是一条镜像帖。来源:北邮人论坛 / job-info / #971162同步于 2025/1/6
该镜像源已超过 30 天没有更新,可能在源站已被删除。
JobInfo机器人发帖
【社招】【知名大模型公司】多模态算法,数字人算法,大模型对
DLL641388166
2025/1/6镜像同步0 回复
订阅后,新回复会通过你的通知中心匿名送达。
0 条回复
暂无回复 · 你可以订阅本帖等待新回复。