← 发现更多职位
字节跳动
社招 · 正式

多模态识别算法工程师-抖音直播

面议
Beijing(北京) · 经验要求见详情
研发社招 · 正式A205395

关于这个机会

1、负责直播业务的主播多模态内容理解、内容识别和内容挖掘的模型建设,提升直播侧内容供给和增长; 2、负责直播场景下计算机视觉、音频、文本大模型的优化与迭代,包括直播间画面识别和检测、文本语义理解和总结,大模型智能助手等; 3、探索计算机视觉、多模态、LLM等前沿技术,负责算法模型的设计开发和调优。

任职要求

1、在计算机视觉、 NLP、多模态、深度学习某个领域有较深入的研究,包括但不限于:图像视频理解、检测、分割、动作识别、多模态、RAG、少样本学习等; 2、熟悉PyTorch/TensorFlow其中一种或多种框架模型的训练和部署,了解混合精度训练、分布式训练、TensorRT部署等; 3、有较强的模型开发和调优能力,在视频内容理解或多模态检索方向有项目经验者优先,在Kaggle、COCO、ActivityNet、ICPC、NOI/IOI等比赛获奖者优先; 4、优秀的理解沟通和团队协作能力,积极主动有热情。

官方来源与核验

字节跳动官方招聘 · 职位编号 7270448797925755191

官方发布时间:

最近核验:2026-09-16T12:33:12.416632+00:00

查看官方职位详情 ↗

内推申请说明

本站为独立内推协助平台。申请会交由管理员核实岗位与内推渠道,不等于已在公司官网投递;薪资、岗位状态和实际招聘流程以官方信息为准。