直招.cv

← 返回职位列表

涂鸦智能 · 社会招聘

资深AI语音算法工程师

杭州 ·经验不限·学历不限

杭州

职位描述

核心目标: 主导云端大规模端到端语音识别(ASR)及相关算法体系的研发与落地,在复杂声学环境下持续提升识别准确率、稳定性与吞吐效率,推动技术产品化与商业化。 岗位职责: 1. 技术方向规划:主导云端语音识别方向的技术路线与攻关规划,带领语音算法团队完成核心模型的研发、迭代与上线,对识别效果与商业化指标负责。 2. ASR 核心算法研发:主导大规模端到端 ASR 系统的声学模型(AM)与语言模型(LM)优化及解码器调优,提升远场、高噪声、口音、多语种等复杂场景下的识别准确率。 3. 高性能 VAD:负责 VAD 算法设计与训练,解决远场、高噪声、双讲及复杂背景音下的静音截断与语音触发难题。 4. 前沿技术探索:推动 LLM + Speech、长音频对齐、多语种混合识别、流式识别等前沿方向的预研与落地。 5. 工程落地与推理加速:协同工程团队完成算法云端落地,主导模型压缩、蒸馏、量化及推理加速,保障高吞吐、低延迟与成本可控。 6. 数据闭环建设:主导自动化数据标注与清洗流水线,通过弱监督、主动学习等手段构建持续迭代的数据飞轮。 任职要求: 1. 计算机、电子信息、信号处理等相关专业,硕士及以上优先;3 年以上语音识别/语音算法研发经验。 2. 具备语音算法团队管理或 TL 经验,主导过 ASR/语音方向的技术规划与项目落地。 3. 精通数字信号处理与深度学习基础理论,熟悉常用语音特征提取;对主流 ASR 架构(CTC / RNN-T / Attention(AED) / Conformer 等端到端模型)有深入理解。 4. 熟练掌握 Python / C++,算法实现能力优秀;熟练使用 PyTorch / TensorFlow 至少一种框架,熟悉主流语音框架(Kaldi / WeNet / ESPnet 等)。 5. 具备 Linux 开发经验,熟悉多线程、异步编程及模型部署流程;有大规模线上语音系统落地经验。 6. 具备良好的英语论文阅读能力,持续追踪语音领域顶会(Interspeech、ICASSP 等)进展。 加分项: 1. 在语音国际竞赛(CHiME、Interspeech 相关评测等)获前排名次,或在顶会发表过相关论文。 2. 有基于神经网络的 VAD 开发经验,能有效区分人声、噪声、音乐及环境异响。 3. 熟悉 LLM + Speech 结合,或对 Whisper 等模型有深度调优经验。 4. 熟悉模型量化、剪枝,有 GPU 推理优化或流式识别系统开发经验。

最后确认在招:2026-09-01 19:04:40 · 来源平台:moka