腾讯
社会招聘原生多模态算法研究员
面议
关于这个机会
1.参与原生多模态基座模型的核心研发,推动模型架构演进,实现图像、视频、音频与文本的全模态统一理解与高质量生成; 2.负责多模态算法优化,包括统一模态表示设计、多模态预训练策略、多尺度/长序列建模、生成一致性等前沿技术攻关; 3.探索模型架构优化与工程实现,提升超高分辨率图像、长视频等复杂场景下的计算效率与性能; 4.持续跟踪多模态领域前沿进展,推动技术突破与创新应用。
任职要求
1.计算机科学、人工智能、视觉计算、自然语言处理等相关专业硕士或博士学历; 2.深入理解多模态技术发展,熟悉 ViT、多模态预训练、自回归模型等技术路线,在 CVPR/ICLR/NeurIPS 等顶会有发表经验者优先; 3.具备强大的工程能力,精通 PyTorch,熟悉 DeepSpeed、Megatron-LM 等分布式训练框架,有超大规模模型训练经验者优先; 4.熟练掌握 Python,具备高性能算子开发或 CUDA 编程等底层优化能力者更佳; 5.对技术充满热情,具备优秀的复杂问题解决能力、坚韧的研发毅力和良好的团队协作精神。
内推申请说明
本站为独立内推协助平台。申请会交由管理员核实岗位与内推渠道,不等于已在公司官网投递;薪资、岗位状态和实际招聘流程以官方信息为准。