← 发现更多职位
字节跳动
社招 · 正式

大模型数据工程师-Seed

面议
Beijing(北京) · 经验要求见详情
研发大数据社招 · 正式A00638

关于这个机会

团队介绍:字节跳动Seed团队成立于2023年,致力于寻找通用智能的新方法,追求智能上限,为科技和社会发展作出贡献。 Seed团队在AI领域拥有长期愿景与决心,团队研究方向涵盖MLLM、GenMedia、AI for Science、机器人等,在中国、新加坡、美国等地设有实验室和岗位。目前,团队已推出业界领先的通用大模型以及前沿的多模态能力,支持豆包、即梦、TRAE等超过50个应用场景,并通过火山引擎开放给企业客户。第三方数据显示,豆包App用户量在中国市场排名第一,豆包大模型日均Token调用量行业领先。 1、设计实现高性能、可扩展、分布式的数据基建,涵盖数据存储、采集、清洗、标注、管理、分析等全生命周期,持续提升数据工作效率; 2、音视频多模态训练数据策略设计,开发高效的数据处理、合成、优化算子和流水线,构建多模态数据资产库,保障大模型研发的数据需要; 3、结合Agent,构建“数据-模型-评测”闭环,通过数据驱动大模型快速迭代; 4、追踪大模型数据领域前沿技术与方法,探索数据增强、数据蒸馏、高质量数据筛选等创新方案,落地到实际业务场景,提升数据价值。

任职要求

1、本科及以上学历,计算机、数学、人工智能等相关专业,在音视频、文本大模型等一个或多个领域有较深入的经验; 2、熟练掌握C/C++、Python、Go等至少一门编程语言,熟悉Ray、Spark相关技术栈; 3、熟练使用AI Coding工具,熟悉CLI、Skills、Agent相关技术栈; 4、有大模型研发经验,参与过有行业影响力的项目者优先; 5、具备良好的沟通协作能力与团队意识,工作积极主动,愿意主动学习新技术、探索新方向,与团队共同推进技术突破。

官方来源与核验

字节跳动官方招聘 · 职位编号 7273049598015408442

官方发布时间:

最近核验:2026-09-16T12:33:12.416632+00:00

查看官方职位详情 ↗

内推申请说明

本站为独立内推协助平台。申请会交由管理员核实岗位与内推渠道,不等于已在公司官网投递;薪资、岗位状态和实际招聘流程以官方信息为准。