← 发现更多职位
字节跳动
社招 · 正式

高性能推理优化研发工程师 - 安全与风控

面议
Beijing(北京) / Shenzhen(深圳) · 经验要求见详情
研发安全社招 · 正式A237915

关于这个机会

团队介绍:我们团队研发尖端云安全解决方案,为字节跳动及企业客户提供规模化安全防护。 依托安全部门深厚的技术积累,以及对客户安全需求的深刻理解,我们借助领先技术与产品,通过全方位智能防御体系应对各类实际安全挑战。 我们的工作确保云环境始终安全、可靠,为整个组织的创新实践提供有力支撑。 1、我们正在寻找AI Infra研发工程师,负责在丰富业务场景中围绕大模型推理全链路,结合云原生架构与推理引擎优化,打造高性能、高可靠的AICC机密推理基础设施,为火山引擎大规模AI算力平台提供底层技术支撑; 2、推理引擎适配优化:负责大模型推理引擎在可信环境下的适配与性能优化,涵盖批处理并行策略、显存管理、KV Cache调度及算子层优化等方向,深度挖掘并解决性能瓶颈,提升机密推理场景下的资源利用率; 3、云原生部署体系:基于Kubernetes构建推理工作负载的高效部署与编排体系,设计智能路由调度策略与弹性伸缩机制,支撑大规模GPU集群上的机密推理服务,同时实现与云原生资源调度、镜像分发、存储网络、监控可观测性等底层平台的对接与协同整合; 4、工程效率与稳定性:建设面向可信AI Infra的CI/CD流水线、自动化测试与运维体系,结合Agent探索AIOps落地应用,提升部署效率与线上稳定性,保障大规模集群的SLA。

任职要求

1、计算机科学、软件工程、电子工程等相关专业硕士学位及以上; 2、系统编程能力:熟练掌握Python/C++/Go/Rust中至少两门编程语言,具备扎实的系统软件设计与开发能力; 3、云原生与K8s:深入理解Kubernetes架构与核心原理,具备Operator、CRD、CSI/CNI等扩展开发经验,熟悉Helm、Argo CD等云原生工具链; 4、推理引擎经验:熟悉至少一种大模型推理框架(SGLang、vLLM等),了解KV-Cache、模型量化技术、PagedAttention等核心机制; 5、高性能系统优化:具备系统性能调优经验,熟悉CPU/GPU架构、内存层次、I/O路径等,能够定位并解决系统级性能瓶颈;对eBPF、torch.profiler、Nsight等使用熟悉者优先,有国产卡调优经验者优先;熟悉TEE等可信计算环境下相关软硬件特点优先; 6、工程落地能力:具备良好的工程素养与项目管理能力,能够独立完成从方案设计到线上落地的全流程,有分布式系统开发经验者优先。

官方来源与核验

字节跳动官方招聘 · 职位编号 7670394261703493893

官方发布时间:

最近核验:2026-09-16T12:33:12.416632+00:00

查看官方职位详情 ↗

内推申请说明

本站为独立内推协助平台。申请会交由管理员核实岗位与内推渠道,不等于已在公司官网投递;薪资、岗位状态和实际招聘流程以官方信息为准。