← 发现更多职位
字节跳动
社招 · 正式

多模态内容理解算法专家-抖音直播(深圳/北京)

面议
Shenzhen(深圳) · 经验要求见详情
研发算法社招 · 正式A168970A

关于这个机会

1、负责抖音直播实时互动相关的多模态内容理解工作,打造业界领先的多模态内容理解大模型; 2、基于CNN、VLM等技术推进模型训练、微调、评测及高效部署,推动模型在下游业务上的应用,包括并不限于多模态对话、多模态互动内容生成、Caption文本生成等,助力业务规模应用落地; 3、规划实现并优化海量多模态数据的预处理、清洗、标注、特征提取及高效融合方法。

任职要求

1、本科及以上学历,计算机相关专业; 2、在计算机视觉/多模态某领域有深入的研究或项目经验,在顶级学术会议有论文发表者或获得竞赛优胜者优先; 3、熟悉多模态大模型(VLM)、大语言模型(LLM)、RL相关的算法技术,熟悉大模型相关的数据构造方法、Post Training算法,对多模态数据处理具备优秀的独立开发与调试能力; 4、有模型训练、压缩、蒸馏、微调等经验,熟悉Megatron、Deepspeed等框架者优先; 5、对视觉CoT有研究经验者优先,对类GPT-4o实时对话的多模态流式计算有落地经验者优先; 6、优秀的分析和解决问题的能力,对解决具有挑战性的问题充满激情,良好的沟通和团队合作能力。

官方来源与核验

字节跳动官方招聘 · 职位编号 7532536702407002376

官方发布时间:

最近核验:2026-09-16T12:33:12.416632+00:00

查看官方职位详情 ↗

内推申请说明

本站为独立内推协助平台。申请会交由管理员核实岗位与内推渠道,不等于已在公司官网投递;薪资、岗位状态和实际招聘流程以官方信息为准。