← 发现更多职位
字节跳动
社招 · 正式

音频算法工程师-抖音直播

面议
Shenzhen(深圳) · 经验要求见详情
研发社招 · 正式A42183

关于这个机会

1、负责抖音直播中低延迟音频理解和生成模型的能力建设,为实时对话智能体提供音频技术支持,包括但不限于ASR、TTS、端到端语音大模型、音频分类等; 2、负责关键场景的算法优化,构建高质量低延迟的智能体系统,提升业务效果; 3、跟进业界前沿的音频技术,探索多模态感知交互能力的边界并落地产品。

任职要求

1、计算机、人工智能、模式识别等相关专业本科及以上学历; 2、熟悉Linux系统和常用的数据结构,熟练使用Python/C++等至少一种编程语言,熟练使用TensorFlow/PyTorch等至少一种深度学习框架; 3、深入理解端到端语音大模型的原理和架构,熟悉常见的语音大模型,如Whisper等,对语音识别、合成、对话理解等技术有扎实的理论基础; 4、在语音、人工智能领域的会议和期刊,如ICASSP、Interspeech、NIPS、ICML、ICLR等发表过论文,或在相关竞赛中取得优异成绩者优先; 5、优秀的分析和解决问题的能力,对解决具有挑战性的问题充满激情,良好的沟通和团队合作能力。

官方来源与核验

字节跳动官方招聘 · 职位编号 7551414890125527303

官方发布时间:

最近核验:2026-09-16T12:33:12.416632+00:00

查看官方职位详情 ↗

内推申请说明

本站为独立内推协助平台。申请会交由管理员核实岗位与内推渠道,不等于已在公司官网投递;薪资、岗位状态和实际招聘流程以官方信息为准。