AI大模型应用能力评估实习生 - AI数据与安全
关于这个机会
团队介绍:AI 数据与安全团队为 Seed 基座模型及 AI 原生应用提供跨模态数据服务,覆盖数据生产全流程,包含模型评估标准的制定、数据规模化生产、数据飞轮搭建,不断提升数据质量,支持模型快速迭代。 团队由产品经理、数据工程、数据运营等跨职能人才组成,并通过与 Seed 研究员、行业专家、全球顶尖数据供应商紧密合作,从真实场景中收集反馈并分析模型表现数据,解决 AI 前沿突破过程中的复杂数据问题,推动模型性能与用户体验的双重提升。我们既是帮助模型技术迭代的一线贡献者,也是模型和 AI 产品的一手用户。 日常实习:面向全体在校生,为符合岗位要求的同学提供为期3个月及以上的项目实践机会。 1、参与AI大模型应用能力评估工作,围绕垂类业务场景(如Model Spec和商业化),根据业务目标拆解评估维度,协助设计评估集、评估标准与自动评估工具; 2、参与设计和迭代自动评估Workflow,理解LLM as a Judge的基本思路,能结合规则校验、模型评分、抽样复核等方式提升评测效率,并协助完成模型选型、评估指标定义和模型效果对比分析; 3、对模型输出进行评估、复核和问题归因,识别负面案例类型,沉淀模型能力短板和优化建议; 4、结合真实业务链路构造复杂、多轮、边界型评测样本,关注模型在意图理解、信息准确性、风格一致性、任务完成度等方面的表现; 5、与产品、算法、运营、数据等团队同学协作,跟进问题定位、需求推进和结果闭环。
任职要求
1、本科及以上学历在读,计算机、人工智能、数据科学、统计学、信息管理、语言学、心理学、商科等相关专业优先; 2、日常实习:面向全体在校生,为符合岗位要求的同学提供为期3个月及以上的项目实践机会; 3、具备较强的结构化分析能力,能把抽象问题拆解成清晰的评估维度和可执行标准; 4、沟通协作能力强,能主动对齐目标、同步进展、推动问题解决,具备较强的闭环意识,能对自己负责的任务从理解需求、执行交付到结果复盘完整跟进; 5、灵活变通,面对需求或临时变化时,能快速理解背景、调整方案并推进落地。
内推申请说明
本站为独立内推协助平台。申请会交由管理员核实岗位与内推渠道,不等于已在公司官网投递;薪资、岗位状态和实际招聘流程以官方信息为准。