Token Foundry · 校园招聘
音频多模态算法研究与应用-阿里星
杭州 ·经验不限·学历不限
北京·杭州
职位描述
1、负责语音生成/语音识别/语音合成/声纹/语种/情感等方向的算法研究和开发;
2、负责语音信号处理的相关算法研究和开发,包括语音增强、回声消除、混响消除、自动增益控制、波达方向估计、波束形成等;
3、负责口语语言理解/用户意图理解/对话模型/语音交互等算法研究和开发;
4、语音统一多模态大模型:研究下一代多模态通用大模型技术范式,实现文本、语音、视觉模态的联合建模。
【任职要求】
1、计算机科学或相关专业硕士及以上学历,具有扎实的计算机、机器学习等理论基础;
2、熟练掌握至少一种编程语言,具备扎实的技术基础;
3、熟悉深度学习、信号处理、语音识别、语音合成、口语语言处理、语音交互、人工智能等类似领域;
4、有良好的自我学习能力及自驱力,对前沿领域有强探索欲和好奇心、善于独立思考并反思总结;具备良好的沟通能力和团队协作能力。
最后确认在招:2026-09-01 19:06:52 · 来源平台:alibaba