← 发现更多职位
字节跳动
社招 · 正式

大模型推理研发专家-基础设施

面议
Beijing(北京) · 经验要求见详情
研发社招 · 正式A122620

关于这个机会

1、负责构建性能领先的LLM推理服务引擎与平台,大模型推理性能优化,参与Servingkit的研发等开发工作; 2、负责LLM推理服务的全链路性能分析、瓶颈定位与优化,能够深入理解大模型推理服务,通过极致的系统优化,在满足SLO/SLA要求的前提下,最大化推理系统的吞吐、降低时延,并实现成本与性能的最佳平衡; 3、负责大模型推理前瞻性技术架构的调研和引入,技术方案不限于编译优化、模型量化等。

任职要求

1、熟练掌握Linux环境下的C/C++与Python语言,有大规模机器学习系统相关经验; 2、熟悉至少一种大模型训练/推理框架,包括但不限于:推理(vLLM、TensorRT-LLM、SGLang等)、机器学习框架(Tensorflow/PyTorch等); 3、具备定位和解决复杂系统性能瓶颈的丰富经验,善于运用各类性能分析工具(Perf、eBPF、Nsight等); 4、优秀的跨团队沟通与协作能力,独立负责并推进大型技术项目。 加分项 1、在主流大模型推理框架(SGlang、vLLM、TensorRT-LLM 等)有深入使用或二次开发经验者优先; 2、理解GPU硬件架构,理解GPU软件栈(CUDA,cuDNN),具备GPU性能分析的经验; 3、对InfiniBand/RDMA网络编程与性能调优有实践经验。

官方来源与核验

字节跳动官方招聘 · 职位编号 7595055025610279221

官方发布时间:

最近核验:2026-09-16T12:33:12.416632+00:00

查看官方职位详情 ↗

内推申请说明

本站为独立内推协助平台。申请会交由管理员核实岗位与内推渠道,不等于已在公司官网投递;薪资、岗位状态和实际招聘流程以官方信息为准。