通义实验室 · 社会招聘
Token Foundry-语音合成与音频生成大模型算法专家-Qwen Audio
杭州 ·3年以上·硕士
北京·杭州
薪资面议
前往 通义实验室 官网投递
职位描述
1.参与前沿语音生成大模型的研发,涵盖数据体系设计、模型架构设计、训练优化等。
2.探索语音合成、声学建模、自然语言处理等多模态融合技术,提升模型在语音质量、自然度及逻辑推理能力上的表现。
3.针对实际应用场景(音色克隆、情感控制等)优化模型效果和性能,解决复杂技术难题。
【任职要求】
1.计算机科学、人工智能、电子工程、应用数学等相关专业硕士及以上学历。
2.具备扎实的机器学习、深度学习理论基础,精通语音生成相关技术。
3.熟练至少一种大模型训练框架(Deepspeed, Megatron),有大模型训练经验。
4.有较强的学习能力和问题解决能力,有自驱力,能快速掌握新技术并应用于实践。
5.发表过相关领域顶级会议论文(NeurIPS、ICML、ICLR、ACL、Interspeech、ICASSP等)、参与行业有影响力项目或者ACM竞赛获奖者优先。
最后确认在招:2026-09-01 19:09:38 · 来源平台:alibaba