字节跳动 社会招聘
多模态算法工程师(即梦AI方向) - 剪映CapCut
深圳 ·经验不限·学历不限
深圳·北京
薪资面议
前往 字节跳动 官网投递
职位描述
团队介绍:剪映研发团队,主要支持剪映、CapCut、醒图、Hypic、即梦、Dreamina、小云雀、Pippit等多款国内外产品的研发工作,业务覆盖多元化影像创作场景,并孵化了多款AIGC明星产品,相关产品多次登顶国内外App Store 免费应用榜第一,并继续保持高速增长。加入我们,一起打造全球最受用户欢迎的影像创作和GenAI产品。
1、负责即梦多模态创作基础模型及应用算法研发,围绕图文、视频理解、时序建模、跨模态对齐、创意扩写、图像视频生成与编辑持续提升模型能力,重点解决复杂意图理解、主体与场景一致性、时序稳定性、生成质量和推理效率等问题;
2、建设以真实用户反馈为牵引的数据与评测闭环,开展高价值样本挖掘、合成数据生产、偏好与奖励信号建模、难例回流和效果评估,推动用户反馈稳定转化为模型优化信号;
3、探索具备上下文理解、复杂推理和工具协同能力的多模态创作智能体,提升创意规划与迭代编辑体验,沉淀可复用的模型能力,支持即梦多种创作链路,并探索以多模态大模型为核心的新创作交互与产品形态。
【任职要求】
1、本科及以上学历,计算机、人工智能、电子、自动化、数学等相关专业,硕士学位、博士学位或具有突出科研成果者优先;
2、具备扎实的数学、算法、机器学习与深度学习基础,以及良好的英文论文阅读和快速验证能力;
3、熟悉多模态大模型或生成式基础模型,在图像/视频理解、图像视频生成与编辑、VLM后训练、多模态数据与评测等任一方向具有良好的项目或研究经验,理解视觉编码、跨模态融合、时序建模、数据构造、预训练、后训练与模型评测的基本方法;
4、具备优秀的代码、实验和工程能力,熟练掌握Python、PyTorch;能够独立完成数据处理、模型训练、效果评测与问题定位,并在指令微调与偏好对齐(SFT、DPO/GRPO、RLHF/RLVR、OPD)、生成模型训练(DiT或自回归)或模型蒸馏中至少有一项实际经验。
加分项:
1、在CVPR、ICCV、NeurIPS、ICLR、SIGGRAPH等会议或期刊发表高水平论文,或在多模态理解、视频生成、基础模型、强化学习等方向取得具有影响力的研究成果;
2、有大规模分布式训练、后训练框架二次开发、模型推理优化或线上部署经验,有高质量开源项目、算法竞赛获奖经历者优先;
3、在多模态大模型、视频理解与生成、偏好对齐、内容规划或生成评测等领域主导过项目,并取得可量化的模型效果或业务结果。
官网发布:2026-07-21 · 最后确认在招:2026-09-03 19:35:21 · 来源平台:feishu