涂鸦智能 · 校园招聘
音频算法工程师
杭州 ·经验不限·硕士
杭州
薪资面议
前往 涂鸦智能 官网投递
职位描述
岗位职责
1. 参与云端大规模端到端语音识别(ASR)系统的算法研发,包括声学模型、语言模型的优化,提升各种复杂环境下的识别准确率。
2. 负责高性能 VAD(语音活动检测)算法的设计与训练,解决云端音频在远场、高噪声、双讲及复杂背景音下的静音截断与语音触发难题。
3. 探索并应用语音领域前沿技术,如大语言模型在语音识别中的应用、长音频对齐、多语种混合识别等。
4. 协同工程团队完成算法在云端的工程落地,参与模型压缩、蒸馏及推理加速,保障高吞吐与低延迟。
5. 参与构建自动化数据标注与清洗流水线,通过弱监督学习、主动学习等手段持续迭代算法性能。
任职要求
1. 精通数字信号处理与深度学习基础理论,熟悉常用的语音特征提取方法。
2. 熟悉主流语音识别框架,对主流架构有深入理解。
3. 熟练掌握 Python/C++,具备优秀的算法实现能力;熟练使用 PyTorch / TensorFlow 至少一种深度学习框架。
4. 具备基本的 Linux 开发经验,了解多线程、异步编程及基本的模型部署流程。
5. 具备良好的英语论文阅读能力,对语音技术充满热情,能主动追踪顶会进展。
加分项
1. 在语音相关国际竞赛获得前排名次,或在顶级会议发表过相关论文。
2. 有过基于神经网络的 VAD 开发经验,能有效区分人声、噪声、音乐及环境异响。
3. 熟悉 LLM + Speech 结合或对 OpenAI Whisper 等模型有深度调优经验。
4. 熟悉模型量化、剪枝,有 GPU 推理优化或流式识别系统开发经验。
最后确认在招:2026-09-01 19:02:59 · 来源平台:moka