← 发现更多职位
字节跳动
社招 · 正式

多模态大模型算法工程师-抖音电商

面议
Beijing(北京) · 经验要求见详情
研发社招 · 正式A253368

关于这个机会

1、多模态大模型算法研发:构建电商领域的多模态大模型底座,融合电商的知识,快速落地电商业务,例如:沉淀电商大模型预训练链路,研发电商图文或者视频多模态大模型和相关应用链路; 2、基础算法研发:持续建设和深耕CV/多模态基础预训练算法,例如:沉淀&优化电商场景的预训练模型,基于电商图片/视频自监督,适配电商商品的多模态表征学习等; 3、梳理&沉淀算法库,抽象算法接口,最大化提高算法/预训练模型的复用率,同时优化数据采集&模型训练&部署&推理的流程,提升研发效率; 4、技术输出:定期分享SOTA模型,赋能电商甚至公司级别的业务BU,沉淀专利和论文。

任职要求

1、扎实的机器技术基础,了解前沿的AI技术,发表过高水平学术会议论文或者有竞赛经验者优先; 2、熟悉多模态大模型工作优先,包括但不限于Llava,Mini-Gemini,Qwen-VL,Shikra等; 3、在多媒体和计算机视觉某个领域有较深入的研究,包括但不限于:图像搜索、图像/视频分类和识别、图像分割、目标检测、图文多模态模型、和视频文本多模态模型等; 4、有CV/多模态大模型相关项目经验优先;研发&优化电商视频&商品多模态大模型,结合LLM和视频/商品表征,支持视频多模态分类,视频QA,跨模态检索,商品分类等任务,显著超越线上模型; 5、有较强的实践能力,在Kaggle,COCO,ImageNet,ActivityNet等比赛获奖者优先;有顶级学术会议(如CVPR、ICCV、ECCV等)发表论文者优先。

官方来源与核验

字节跳动官方招聘 · 职位编号 7367260190985619738

官方发布时间:

最近核验:2026-09-16T12:33:12.416632+00:00

查看官方职位详情 ↗

内推申请说明

本站为独立内推协助平台。申请会交由管理员核实岗位与内推渠道,不等于已在公司官网投递;薪资、岗位状态和实际招聘流程以官方信息为准。