直招.cv

← 返回职位列表

涂鸦智能 · 校园招聘

音频算法工程师

杭州 ·经验不限·硕士

杭州

职位描述

岗位职责 1. 参与云端大规模端到端语音识别(ASR)系统的算法研发,包括声学模型、语言模型的优化,提升各种复杂环境下的识别准确率。 2. 负责高性能 VAD(语音活动检测)算法的设计与训练,解决云端音频在远场、高噪声、双讲及复杂背景音下的静音截断与语音触发难题。 3. 探索并应用语音领域前沿技术,如大语言模型在语音识别中的应用、长音频对齐、多语种混合识别等。 4. 协同工程团队完成算法在云端的工程落地,参与模型压缩、蒸馏及推理加速,保障高吞吐与低延迟。 5. 参与构建自动化数据标注与清洗流水线,通过弱监督学习、主动学习等手段持续迭代算法性能。 任职要求 1. 精通数字信号处理与深度学习基础理论,熟悉常用的语音特征提取方法。 2. 熟悉主流语音识别框架,对主流架构有深入理解。 3. 熟练掌握 Python/C++,具备优秀的算法实现能力;熟练使用 PyTorch / TensorFlow 至少一种深度学习框架。 4. 具备基本的 Linux 开发经验,了解多线程、异步编程及基本的模型部署流程。 5. 具备良好的英语论文阅读能力,对语音技术充满热情,能主动追踪顶会进展。 加分项 1. 在语音相关国际竞赛获得前排名次,或在顶级会议发表过相关论文。 2. 有过基于神经网络的 VAD 开发经验,能有效区分人声、噪声、音乐及环境异响。 3. 熟悉 LLM + Speech 结合或对 OpenAI Whisper 等模型有深度调优经验。 4. 熟悉模型量化、剪枝,有 GPU 推理优化或流式识别系统开发经验。

最后确认在招:2026-09-01 19:02:59 · 来源平台:moka