← 发现更多职位
Token Foundry
社会招聘

Token Foundry-视觉语言大模型算法工程师-Qwen

面议
北京 / 杭州 / 上海 · 2年以上
技术类-算法硕士社会招聘

关于这个机会

1. 多模态Pre-training:开展研究及进行实验。研究内容包括:数据清洗与筛选、数据配比优化、课程学习、视觉语言模型结构设计与优化、训练策略优化、预训练数据合成、scaling law预测、词表优化、模型蒸馏与压缩、长上下文能力优化等。 2. 多模态Post-training:迭代Post-training训练策略(SFT/RLHF),专项能力数据迭代,参与模型能力评测及评测数据和评估标准的迭代。 3. 多模态推理和通用Agent:通过强化学习(RL)持续提升多模态模型推理能力和执行任务能力,打造多模态的Test Scaling Laws,并推动模型对网络和虚拟世界的交互和任务完成能力。 4. 统一理解生成:构建视觉统一理解生成大模型,推进多模态统一生成与理解的推理和交互新范式。

任职要求

1. 计算机科学、计算机视觉、人工智能、机器学习、具身智能等领域的博士/硕士毕业生。 2. 较强的代码能力,擅长模型训练及数据处理;精通Python及PyTorch等深度学习框架;熟悉Transformer架构以及CV、大语言模型基础知识。 3. 善于平衡研究目标及落地实现,具备跨学科视野与协作意识,能够与工程、产品等多学科团队紧密合作,推动研究成果快速落地并产生实际影响力。 4. 关注技术影响力,具有开源开放精神,对基础模型的前沿问题有持续热情,具备独立思考能力和系统性研究思维,敢于挑战现有范式,能够独立应用技术解决复杂问题。 加分项 1. 曾发表顶级会议论文并具有一定的学术影响力,包括但不限于:CVPR、ECCV、NeurIPS、ICML、ICLR、ACL、TPAMI等国际顶级计算机会议/期刊。 2. 拥有知名开源项目,在开源社区具有较好的影响力,或在竞赛中获得引领性的研究成果。 3. 具有大规模预训练实战经验。

官方来源与核验

阿里巴巴官方招聘 · 职位编号 7000033602

最近核验:2026-09-16T10:06:06.548674+00:00

查看官方职位详情 ↗

内推申请说明

本站为独立内推协助平台。申请会交由管理员核实岗位与内推渠道,不等于已在公司官网投递;薪资、岗位状态和实际招聘流程以官方信息为准。