直招.cv

← 返回职位列表

字节跳动 校园招聘

视觉多模态应用算法(视频通话方向)实习生-Seed

北京 ·经验不限·学历不限

北京

职位描述

ByteIntern:面向2027届毕业生(2026年9月-2027年8月期间毕业),为符合岗位要求的同学提供转正机会。 团队介绍:字节跳动Seed团队成立于2023年,致力于寻找通用智能的新方法,追求智能上限,为科技和社会发展作出贡献。 Seed团队在AI领域拥有长期愿景与决心,团队研究方向涵盖MLLM、GenMedia、AI for Science、机器人等,在中国、新加坡、美国等地设有实验室和岗位。目前,团队已推出业界领先的通用大模型以及前沿的多模态能力,支持豆包、即梦、TRAE等超过50个应用场景,并通过火山引擎开放给企业客户。第三方数据显示,豆包App用户量在中国市场排名第一,豆包大模型日均Token调用量行业领先。 1、参与视频通话模型Post-training的优化和研发,包括通话长多轮对话体验的优化、视觉感知能力、联网搜索能力、记忆、Agent调用能力等; 2、研发视频通话的新特性,包括主动响应、音视频双工等特性; 3、参与智能硬件相关能力的优化,提升端到端用户体验; 4、探索各种前沿创新性技术,并转化为应用侧效果。 【任职要求】 1、2027届硕士及以上学位在读,人工智能、计算机、自动化、数学等相关专业优先; 2、有视频大模型训练、智能硬件相关研究经验者优先,在学术会议上发表过多模态大模型相关研究论文者优先; 3、责任心强,积极主动,有良好的沟通能力和团队合作能力,对视频通话、智能硬件应用有强烈兴趣者优先。

官网发布:2026-04-23 · 最后确认在招:2026-09-03 19:26:41 · 来源平台:feishu