← 发现更多职位
字节跳动
社招 · 正式

AIGC基础算法工程师-多模态大模型

面议
Beijing(北京) · 经验要求见详情
研发算法社招 · 正式A205463

关于这个机会

1、探索VLM模型Midtrain与Post-train尖端技术,深耕Reasoning RL、Think with Image、多模态推理等方向,突破模型通用认知与复杂推理边界; 2、探索VLM/Agent与AIGC的深度协同,面向图像、视频、广告创意、素材生成等场景,定义并实现下一代Agentic AIGC系统架构,提升内容生成的可控性、一致性、转化效果和自动化生产效率; 3、负责AIGC算法在商业化内容生产中的应用,包括商品理解、卖点提炼、创意脚本生成、分镜规划、图像/视频生成、素材评估与自动优化等,构建从商品信息到高质量广告素材的端到端智能生产链路; 4、结合广告投放目标与效果数据,探索投放指导生产方法,包括基于人群、场景、平台、转化目标的创意策略生成,分析高表现素材规律,指导AIGC模型生成更适合投放的广告内容,并通过数据反馈持续优化素材生产策略; 5、跟踪业界SOTA技术,开展前瞻性研究,推动VLM、Agent、AIGC、Reasoning RL等方向的技术创新,目标在ICLR、NeurIPS、ACL、CVPR等顶会发表高水平论文,并推动研究成果在业务场景中落地。

任职要求

1、对LLM/VLM/Agent的全生命周期训练,包括Midtrain、Post-Train、SFT、RLHF/RLAIF、Reasoning RL等方向有深厚的理论积累与实战经验; 2、熟悉多模态理解与生成技术,对图像生成、视频生成、文生图/图生视频、多模态一致性、可控生成、AIGC内容评估等方向有研究或项目经验; 3、具备Agent系统或复杂任务自动化经验,理解任务拆解、工具调用、环境交互、轨迹采样、奖励设计、长链路推理等关键技术; 4、有AIGC商业化落地经验者优先,包括广告素材生成、商品视频生成、创意生成、投放素材优化、CTR/CVR导向内容生产、素材质量评估等方向; 5、有较好的编程能力,熟练使用PyTorch、Llama-Factory、Verl等训练框架,具备大规模模型训练、分布式训练或强化学习训练经验。

官方来源与核验

字节跳动官方招聘 · 职位编号 7254773366015428924

官方发布时间:

最近核验:2026-09-16T12:33:12.416632+00:00

查看官方职位详情 ↗

内推申请说明

本站为独立内推协助平台。申请会交由管理员核实岗位与内推渠道,不等于已在公司官网投递;薪资、岗位状态和实际招聘流程以官方信息为准。