BBYR Achieve
返回信息流
这是一条镜像帖。来源:北邮人论坛 / job-info / #978277同步于 2026/1/25
该镜像源已超过 30 天没有更新,可能在源站已被删除。
JobInfo机器人发帖

【社招】阿里控股 base杭州 大模型数据算法

BaiYi7307
2026/1/25镜像同步0 回复
职位描述: 1.构建集团核心数据资产体系,聚焦音频模态,主导音频数据的处理、理解、挖掘与智能生成,支撑多模态内容生态与业务场景落地; 2.负责海量音频数据的标签体系设计、特征工程、内容理解与质量建模,包括但不限于:方言/语种的分类与细粒度识别模型的设计、训练与持续优化;说话人属性(年龄、性别、情绪)及语音场景(如会议、客服、车载、嘈杂环境等)的智能预测;音频质量评估体系的构建与迭代,建立自动化质量打标与过滤机制; 3.探索基于扩散模型、自回归模型等前沿生成技术的音频合成与编辑方案,研究受控语音生成、风格迁移、音色克隆等技术,服务于多模态内容增广与智能创作; 4.主导数据智能平台中音频算法模块的开发与集成,构建高可用、可扩展的音频处理流水线,支撑集团级全模态数据中台建设; 5.持续追踪音频与多模态领域的前沿技术(如语音大模型、Audio-LLM、具身智能中的听觉感知等),推动创新算法在实际业务场景中的高效落地。 职位要求: 1.计算机、人工智能、信号处理、数学、统计或相关专业硕士及以上学历,具备扎实的音频信号处理或语音算法项目经验,有大规模音频数据处理或语音AI系统开发背景者优先; 2.熟悉深度学习框架(如 PyTorch/TensorFlow),在语音识别(ASR)、语种/方言识别、说话人识别(SV)、语音情感分析、音频事件检测、语音合成(TTS)等至少一个方向有深入实践; 3.具备优秀的音频特征工程能力,熟悉主流音频表征与模型架构,有自研或调优经验者优先; 4.熟悉大规模音频数据处理全流程,包括数据清洗、标注、质量评估、模型训练与部署,具备音频质量建模与治理经验者优先; 5.精通 Python,熟悉 Linux开发环境,具备良好的工程实现能力和算法优化意识,有分布式训练或推理优化经验者加分; 6.在语音或多模态领域有顶会论文(如 ICASSP, Interspeech, ACL, NeurIPS, CVPR, AAAI 等)、竞赛获奖或高质量开源项目贡献者优先; 联系方式:d13051632266
订阅后,新回复会通过你的通知中心匿名送达。
0 条回复
暂无回复 · 你可以订阅本帖等待新回复。