直招.cv

← 返回职位列表

字节跳动 社会招聘

视频模型评测专家(音频方向) - AI数据与安全

北京 ·经验不限·学历不限

北京

职位描述

团队介绍:AI 数据与安全团队为 Seed 基座模型及 AI 原生应用提供跨模态数据服务,覆盖数据生产全流程,包含模型评估标准的制定、数据规模化生产、数据飞轮搭建,不断提升数据质量,支持模型快速迭代。 团队由产品经理、数据工程、数据运营等跨职能人才组成,并通过与 Seed 研究员、行业专家、全球顶尖数据供应商紧密合作,从真实场景中收集反馈并分析模型表现数据,解决 AI 前沿突破过程中的复杂数据问题,推动模型性能与用户体验的双重提升。我们既是帮助模型技术迭代的一线贡献者,也是模型和 AI 产品的一手用户。 1、负责多模态大模型在视频音频方向的评测工作,围绕声画一致性、语义匹配、时序对齐、环境真实性、情绪表达等维度评估模型效果,探索能力边界; 2、结合产品需求与模型特点,设计评测方案、测试样本、提示词及评测标准,完善评测体系; 3、对评测结果进行归因分析和报告输出,协同算法、产品、标注等团队推动模型迭代优化。 【任职要求】 1、本科及以上学历,声学、录音工程、音频技术、音频信号处理、数字媒体等相关专业优先; 2、具备数字音频、声学测量、录音技术及音频质量评估基础,能够独立完成主客观结合的评测工作; 3、理解音频生成、视频生成及多模态模型基本原理,具备多模态视角下的问题判断与归因能力; 4、熟悉影视、短视频、纪录片、访谈、Vlog、直播、广告等题材的声音表达要求,能够判断声音与画面的匹配度、环境真实性和叙事一致性; 5、了解并使用过主流AI视频/音频生成工具(Seedance、Minimax H3、可灵)、音频工具(Suno、Elevenlabs),熟悉基础生成方式、工作流及常见问题; 6、具备数据处理、分析和报告输出能力,逻辑清晰,沟通协同能力强,能适应迭代。 加分项 1、有多模态评测、音频评测或主观听感测试经验; 2、熟悉ITU-R BS.1770、EBU R128等音频相关标准; 3、具备音乐制作、影视后期、游戏音频、录音棚或流媒体音频平台相关经验; 4、有视频生成、语音生成、配乐或音效生成等跨模态项目经验者优先。

官网发布:2026-08-05 · 最后确认在招:2026-09-03 19:35:21 · 来源平台:feishu