← 发现更多职位
字节跳动
社招 · 正式

强化学习算法工程师-Data AML

面议
Hangzhou(杭州) · 经验要求见详情
研发社招 · 正式A243165A

关于这个机会

1、负责高质量数据的挖掘和清洗,研究基于业务的样本自动生成方案,设计置信的RL Reward方案; 2、研究LLM/VLM Agent训练算法,尤其是强化学习(RL)的各类算法; 3、负责广告多模态创意创作Agent相关的研发与应用,研究大模型的对齐方法、Agent的设计、端到端训练(Agentic RL)、评测方法等; 4、持续跟踪LLM/VLM、Agent领域的最新技术动态,并将其应用于实际业务场景中,推动技术落地。

任职要求

1、本科及以上学历,具备扎实的机器学习、深度学习与概率统计理论基础,对底层原理有深入理解;熟悉强化学习技术栈并有深入的研究或项目经验,有AIGC相关经验者优先; 2、优秀的代码能力、数据结构和基础算法功底,熟练掌握至少一门语言,ACM/ICPC、NOI/IOI、Top Coder、Kaggle等比赛获奖者优先; 3、在大模型领域,主导过有影响力的项目或论文者优先;在NeurIPS/ICML/ICLR/ACL/EMNLP等顶会发表论文者优先; 4、主动积极、有创新精神,具备出色的沟通协作能力和问题解决能力,对创造一流AI业务应用充满热情。

官方来源与核验

字节跳动官方招聘 · 职位编号 7631123526506170677

官方发布时间:

最近核验:2026-09-16T12:33:12.416632+00:00

查看官方职位详情 ↗

内推申请说明

本站为独立内推协助平台。申请会交由管理员核实岗位与内推渠道,不等于已在公司官网投递;薪资、岗位状态和实际招聘流程以官方信息为准。