字节跳动
社招 · 正式大模型Multi-Agent RL算法研究员-Seed
面议
关于这个机会
1、针对前沿的长程任务进行优化,手段包括但不限于Large-Scale RL、Multi-Agent RL、Multi-Agent Harness Design、Self-Evolving Algorithm;能突破传统发版技术积极思考探索并开展实验; 2、创新Multi-Agent训练技术,推出适合内部Multi-Agent框架的模式。
任职要求
1、对语言模型和强化学习有着深厚的知识储备和深入理解,对AI进行复杂任务有热情和信仰,有很强的研究好奇心和与之匹配的行动力;有AI相关领域的博士学位,或者1年以上AI相关领域核心岗位工作经验; 2、具有丰富的工程知识,熟悉MLsys包括但不限于Verl、Slime、Megatron等开源框架;熟悉现在的主流Agent框架,是Claude Code/Codex等工具的深度用户,了解Agent工程实现细节和对应模型训练技术; 3、工作主动性、行动力强,目标驱动,交流沟通、团队合作意识强、敢于创新,能迅速熟悉字节跳动内外部平台工具使用,具有主动提升效率的意识。
内推申请说明
本站为独立内推协助平台。申请会交由管理员核实岗位与内推渠道,不等于已在公司官网投递;薪资、岗位状态和实际招聘流程以官方信息为准。