AI 研发工程师(大模型应用)
关于这个机会
1. 负责大模型应用、智能体和行业 AI 平台的核心模块设计与研发,包括任务规划、任务拆解、工作流编排、工具调用、记忆、反思和结果验证。 2. 建设模型接入与调用能力,支持同步和流式输出、模型路由、上下文管理、失败重试、降级、限流、超时控制及调用链路追踪。 3. 负责 RAG 相关能力建设,包括文档解析、切分、Embedding、向量检索、Rerank、证据引用和知识库更新。 使用 Python、Go 等技术栈,建设高可用服务、异步任务、消息队列、数据库及模型网关,保障系统稳定性和可维护性。 4. 协同算法团队完成 MiniCPM 及其他模型的服务化封装、性能优化与领域优化,参与 vLLM、SGLang、llama.cpp 或国产芯片推理栈的部署适配。 5. 参与 Docker、Kubernetes、CI/CD、监控、日志、告警和私有化离线安装能力建设,支持客户现场问题定位,并将真实业务需求沉淀为可复用的系统能力。
任职要求
1. 本科及以上学历,计算机、软件工程、人工智能等相关专业优先。 2. 具备扎实的 Python 或 Go 开发能力,熟悉服务端开发、API 设计、数据库和常用中间件。 3. 理解大模型、RAG、Agent 的基本工作方式,至少在其中一个方向有实际项目经验。 4. 熟悉 FastAPI、PostgreSQL/MySQL、Redis、消息队列、Milvus 或其他向量数据库中的部分技术栈。 5. 具备良好的工程习惯,重视自动化测试、日志追踪、故障排查和版本管理,愿意处理从开发、联调到生产运行的完整问题。 加分项 1. 有智能体平台、数字员工、MCP、工具调用、多 Agent 协作或长任务执行经验。 2. 有 vLLM、SGLang、TensorRT-LLM、llama.cpp 或其他国产芯片适配经验。 3. 有端侧、边缘侧、离线环境、信创环境或一体机交付经验。
内推申请说明
本站为独立内推协助平台。申请会交由管理员核实岗位与内推渠道,不等于已在公司官网投递;薪资、岗位状态和实际招聘流程以官方信息为准。