← 发现更多职位
字节跳动
社招 · 正式

多模态大模型数据工程师-智能创作(北京/上海/深圳)

面议
Beijing(北京) · 经验要求见详情
研发大数据社招 · 正式A53336

关于这个机会

1、负责&参与智能创作Seedance/Seedream及Seed VLM视觉大模型后训练的数据生产工作; 2、负责和参与上述场景数据处理Pipeline的框架搭建和优化工作,并通过平台化建设持续提升数据处理效率、自助化程度和易用性; 3、负责十亿级别高质量多模态数据的回流、清洗与血缘管理,建设数据飞轮提升高质量后训练数据集规模; 4、与算法深度合作,参与前沿模型研究中数据解决方案开发和维护,不断提升训练数据质量和规模,提升模型后训练效果。

任职要求

1、硕士学位及以上,计算机、人工智能、软件工程等专业优先; 2、具备3年以上数据处理或模型训练工作经验,熟练掌握文本、多模态等非结构化数据处理方法,熟悉数据清洗、特征提取和数据增强等技术,能够解决数据工作中各种问题; 3、精通Python、Golang、Java等至少一种编程语言,具备良好的编码能力和代码质量意识,熟悉常用的数据处理、文本处理和图像处理库,能够高效地实现数据清洗和处理的算法和流程; 4、掌握大数据开发相关工具,如Spark/Flink/Hadoop/Ray等; 5、具备丰富的数据建模以及数据架构经验,能够对结构化和非结构化数据场景进行统一的建模; 6、具备优秀的分析问题和解决问题能力,勇于挑战困难问题,具备良好的团队协作意识;有图片和视频等多媒体数据处理平台架构建设经验者优先。

官方来源与核验

字节跳动官方招聘 · 职位编号 7296751427396208934

官方发布时间:

最近核验:2026-09-16T12:33:12.416632+00:00

查看官方职位详情 ↗

内推申请说明

本站为独立内推协助平台。申请会交由管理员核实岗位与内推渠道,不等于已在公司官网投递;薪资、岗位状态和实际招聘流程以官方信息为准。