腾讯
校园招聘 · 青云计划-应届生微信秒剪-基于强化学习的视频生成模型优化
面议
关于这个机会
课题背景: 视频生成已成为大模型时代新的热点,大模型厂家纷纷发布视频生成基座模型,但效果优秀的头部模型多为闭源,无法针对业务场景进行定制和适配。开源模型在指令遵循、视觉效果、运动质量上都有一定短板,虽然利用监督学习能在一定程度上弥补短板,但无法针对具体的指标和问题进行直接优化,需要引入强化学习进行针对性提升,闭源产品也都将强化学习作为后训练的重要环节。 强化学习具有收敛难、易发生Reward Hack等难点,在视频生成场景更面临扩散模型计算量大的问题。本课题需要系统性解决强化学习(GRPO等算法)的各项难点,提升视频生成模型(如Wan 2.2、LTX-2.3等)效果,完善音画同步和分镜生成能力,以落地到业务场景中。 岗位价值: 强化学习可以系统性提升视频生成在各个维度的综合能力,解决SFT、LoRA等技术无法处理的问题,但这一技术难度较高,业内多为闭源,强化学习在视频扩散上的技术并不成熟,需要引入能力较强的同学攻克技术难点,系统性提升各种场景下的视频生成质量,提升秒剪、输入法生成场景下的用户体验
任职要求
1、具备独立解决复杂算法难题的能力 2、在多模态(理解和生成等方向)方向有持续深入的耕耘 3、具备丰富的强化学习效果调优经验 4、发表过多篇顶会论文,或具有优秀的多模态开源项目,博士优先
内推申请说明
本站为独立内推协助平台。申请会交由管理员核实岗位与内推渠道,不等于已在公司官网投递;薪资、岗位状态和实际招聘流程以官方信息为准。