腾讯
社会招聘生态发展部-资深游戏测试工程师-Agent评测
面议
关于这个机会
1.负责AI Agent全链路评测与质量保障工作,聚焦Agent能力基准测试、自动化评测基座建设及分级评测指标定义; 2.针对AI生成的非确定性与参数化特点,设计并量化评测标准,搭建科学的分级评测指标体系; 3.主导构建高质量的基准测试集(Benchmark),覆盖多轮交互、长短上下文等复杂场景,解决AI生成结果验证标准量化的核心难题; 4.参与设计和研发Agent自动化评测基座,通过构建自动化测试脚本和引入大模型交叉验证(LLM-as-a-Judge)机制,提升评测效率; 5.建立高效的缺陷定界机制,精准判断问题根因,输出多维度评测报告并协同开发团队推动问题解决。
任职要求
1.本科及以上学历,计算机、软件工程、人工智能等相关专业,3年及以上测试开发/评测经验,具备大模型或AI Agent核心评测经验; 2.深入理解大模型及AI Agent核心运行逻辑,能快速拆解Agent驱动游戏生成的业务链路; 3.具备优秀的逻辑思维与缺陷定界能力,能基于生成日志、链路追踪工具快速定位复杂AI生成异常的根因; 4.具备优秀的跨团队沟通协作能力和执行力,能高效对接算法、研发、产品团队,推动测试工作落地和问题闭环; 5.精通至少一门编程语言,具备扎实的编码基础。
内推申请说明
本站为独立内推协助平台。申请会交由管理员核实岗位与内推渠道,不等于已在公司官网投递;薪资、岗位状态和实际招聘流程以官方信息为准。