Token Foundry · 校园招聘
多模态理解和生成统一的前沿应用研究-阿里星
杭州 ·经验不限·学历不限
北京·杭州
职位描述
1、多模态理解:负责图文/视频/音频理解相关的算法研发,提升模型对复杂多模态场景的语义分析和推理能力;
2、多模态生成:开发基于 Diffusion Model 或 Autoregressive 架构的生成算法(如 Text-to-Image, Text-to-Video),优化生成的质量、多样性与可控性;
3、研究多模态理解和生成统一的数据组织、训练范式等难点问题,大规模多模态理解和生成的训练和应用。
【任职要求】
1、计算机、人工智能、自动化等相关专业;
2、在多模态大模型和生成式模型(扩散/自回归模型)上有资深背景,对前沿进展和领域问题有深入理解;
3、具有主流大模型的实战经验 (视频生成/VLM/LLM/LMM),有国际高影响力的项目成果;
4、对 AGI 有极强的热情,能够从第一性原理出发解决世界模型领域问题。
最后确认在招:2026-09-01 19:06:52 · 来源平台:alibaba