【高阶岗位】Agent 任务与环境青年科学家
数据平台中心|全职|科研通道|上海
2026-09-24
岗位职责
1. 面向大模型 Agent 的训练与评测,负责任务、环境及交互数据的关键技术研究,推动研究原型向可规模化交付的能力转化。
2. 研究任务生成、环境自动构建与验证方法,建设可执行、可复现、可验证的任务环境,提升生产效率、质量与复用性。
3. 建设任务与环境评测体系,研究难度分级、结果校验、奖励设计及评测可靠性,形成高质量基准与自动化验证流程。
4. 与模型团队协作开展轨迹采集、数据合成及后训练实验,验证任务、环境和数据对 Agent 能力的实际贡献。
5. 独立牵引方向内的研发项目,承担需求评估、技术路线设计与交付推进,指导工程师及合作学生,参与骨干培养与团队建设。
2. 研究任务生成、环境自动构建与验证方法,建设可执行、可复现、可验证的任务环境,提升生产效率、质量与复用性。
3. 建设任务与环境评测体系,研究难度分级、结果校验、奖励设计及评测可靠性,形成高质量基准与自动化验证流程。
4. 与模型团队协作开展轨迹采集、数据合成及后训练实验,验证任务、环境和数据对 Agent 能力的实际贡献。
5. 独立牵引方向内的研发项目,承担需求评估、技术路线设计与交付推进,指导工程师及合作学生,参与骨干培养与团队建设。
岗位要求
1. 计算机、人工智能、软件工程等相关专业,博士及以上学历。
2. 在 Agent、代码智能、任务环境构建、自动化评测或大模型后训练等至少一个方向具有深入研究或实践经验,并有可展示的成果。
3. 具备扎实的 Python 编程能力,熟悉 Linux、Docker 及常用深度学习工具,能够独立完成研究原型、实验验证及关键模块开发。
4. 具备较强的问题定义、实验设计与指标分析能力,能够区分模型、数据、环境及评测机制带来的问题,并通过实验验证改进效果。
5. 具备独立负责科研或研发项目的能力,能够拆解目标、判断优先级、协调资源并推动交付,愿意承担技术指导与团队协作职责。
加分项
1. 有代码、办公、科学计算或安全等场景的 Agent 任务集、环境、Benchmark 或 Harness 建设经验。
2. 有大规模环境构建、沙盒运行、轨迹生产或 RLVR 实践经验,了解可复现性、评测泄漏及奖励漏洞等问题。
3. 有高质量论文、开源项目或实际应用成果;有带领小团队、指导学生或组织跨团队合作的经验
2. 在 Agent、代码智能、任务环境构建、自动化评测或大模型后训练等至少一个方向具有深入研究或实践经验,并有可展示的成果。
3. 具备扎实的 Python 编程能力,熟悉 Linux、Docker 及常用深度学习工具,能够独立完成研究原型、实验验证及关键模块开发。
4. 具备较强的问题定义、实验设计与指标分析能力,能够区分模型、数据、环境及评测机制带来的问题,并通过实验验证改进效果。
5. 具备独立负责科研或研发项目的能力,能够拆解目标、判断优先级、协调资源并推动交付,愿意承担技术指导与团队协作职责。
加分项
1. 有代码、办公、科学计算或安全等场景的 Agent 任务集、环境、Benchmark 或 Harness 建设经验。
2. 有大规模环境构建、沙盒运行、轨迹生产或 RLVR 实践经验,了解可复现性、评测泄漏及奖励漏洞等问题。
3. 有高质量论文、开源项目或实际应用成果;有带领小团队、指导学生或组织跨团队合作的经验


