字节跳动
社招 · 正式强化学习算法工程师-剪映CapCut
面议
关于这个机会
1、负责视频创作Agent相关的研发与应用,研究大模型的对齐方法、Agent的设计&端到端训练(Agentic RL)等,跟进LLM、Agent的最新进展; 2、研究LLM/VLM Agent训练算法,尤其是强化学习(RL)的各类算法; 3、高质量数据的挖掘和清洗,研究探索数据自动、半自动合成方案,设计视频创作Agent的评测方法,设计置信的RL Reward方案; 4、持续跟踪LLM/VLM、Agent领域的最新技术动态,并将其应用于实际业务场景中,推动技术落地。
任职要求
1、优秀的代码能力、数据结构和基础算法功底,熟练掌握至少一门语言,ACM/ICPC、NOI/IOI、Top Coder、Kaggle等比赛获奖者优先; 2、深入理解大模型或图片视频生成等相关技术栈(如RLHF、SFT、Dit/Vit/Transformer、Stable Diffusion等),对强化学习(RL)在上述技术栈中的应用机制和潜力有清晰认知,可灵活运用RL优化相关流程; 3、在大模型领域,主导过有影响力的项目或论文者优先;在NeurIPS/ICML/ICLR/ACL/EMNLP等顶会发表论文者优先; 4、有大模型训练经验,有文案生成、创意生成、素材编辑、AI特效等有相关经验,有Agent、Tool-Use、MCP等相关经验优先; 5、出色的问题分析和解决能力,有自主探索解决方案的能力; 6、良好的沟通协作能力,能和团队一起探索新技术,推动技术进步。
内推申请说明
本站为独立内推协助平台。申请会交由管理员核实岗位与内推渠道,不等于已在公司官网投递;薪资、岗位状态和实际招聘流程以官方信息为准。