字节跳动
社招 · 正式视觉大模型算法工程师-国际电商
面议
关于这个机会
1、负责电商场景下大规模视觉、多模态预训练任务,包括商品图片、视频、直播等各个场景下的CV底座,以及多模态大模型的CV底座; 2、负责计算机视觉相关模型的优化与迭代,包括商品图细粒度分类、商品主体识别、品牌识别、短视频和直播的视频分类、多模态内容挖掘和理解等; 3、负责电商场景图像搜索、拍照搜商品、商品消重、视频搬运等基础算法优化迭代; 4、探索计算机视觉前沿技术,视觉大模型、统一视觉底座算法等。
任职要求
1、在多媒体和计算机视觉某个领域有较深入的研究,包括但不限于大规模CV/多模态预训练、自监督学习、图片/视频理解、图像搜索、分割/检测/OCR等; 2、熟悉TensorFlow/PyTorch/MXNet其中一种或多种框架模型的训练和部署,了解混合精度训练、分布式训练等训练加速方法; 3、熟悉模型压缩加速的最新研究和技术进展,包括但不限于模型量化、剪枝、知识蒸馏等,以及TensorRT等Inference框架; 4、有较强的实践能力,在Kaggle,COCO,ImageNet,ActivityNet,ICPC,NOI/IOI等比赛获奖者优先; 5、实践动手能力强,相关竞赛和顶级学术会议(如CVPR、ICCV、ECCV等)发表论文者优先。
内推申请说明
本站为独立内推协助平台。申请会交由管理员核实岗位与内推渠道,不等于已在公司官网投递;薪资、岗位状态和实际招聘流程以官方信息为准。