← 发现更多职位
腾讯
社会招聘

混元大模型音频理解算法工程师(北京)

面议
深圳 · 三年以上工作经验
技术TEGAI中国

关于这个机会

1.负责语音/音频大模型研发,包括音频理解(ASR/音频caption)、音视频理解等模型研发; 2.负责预训练、后训练、强化学习(文本和音频强化)相关的数据、算法、评测工作; 3.负责音频理解/ASR模型开源以及产品落地(比如产品全链路端到端优化、音频理解在噪音/口音/远场/音效音乐场景的优化)。

任职要求

1.有语音识别、音频理解、音乐理解等相关经验者优先; 2.有音视频多模态、大语言模型(预训练、微调、强化学习)等相关经验者优先; 3.优秀的代码能力、数据结构和算法功底,熟练掌握Python,熟悉Pytorch/Megatron/FSDP等模型训练框架、熟悉SLIME/VERL等RL框架优先; 4.有ACM/ICPC、NOI/IOI、Top Coder、Kaggle等比赛获奖者优先; 5.在相关顶级会议或期刊(如NeurIPS/ICLR/ICML/ACL/CVPR/ICASSP/INTERSPEECH等)有论文发表者优先; 6.良好的英语文献阅读能力,强烈的进取心/求知欲/团队合作精神,以及优秀的问题解决能力,热衷于追求技术创新。

官方来源与核验

腾讯官方招聘 · 职位编号 1990262114463404032

最近核验:2026-09-16T14:24:32.302972+00:00

查看官方职位详情 ↗

内推申请说明

本站为独立内推协助平台。申请会交由管理员核实岗位与内推渠道,不等于已在公司官网投递;薪资、岗位状态和实际招聘流程以官方信息为准。