欢迎访问上海招聘网!本站为上海找工作求职者提供上海人才招聘、上海人才市场、上海人才网等岗位信息!


职位月薪: 面议
岗位职责: 团队介绍 我们是 Shopee Sellerbot(商家智能客服)团队。 Sellerbot 是 Shopee 面向全球商家的新一代 AI Agent,为数千万商家提供智能客服、运营助手与业务 Agent 服务。 不同于传统 Chatbot,我们希望构建真正能够理解业务、规划任务、调用工具并解决问题的 AI Agent。例如: 查询订单、物流、退款、处罚等业务系统; 自动完成工单处理、运营配置等复杂流程; 理解商家经营情况并提供经营建议; 与人工客服、RM(Relationship Manager)协同工作; 基于真实线上反馈持续学习与自我优化。 团队专注于将 LLM、AI Agent、Post-Training、RL、Tool Learning 等前沿技术应用到真实业务场景,持续推动 Sellerbot 从"回答问题"演进为"帮助商家完成工作"的智能 Agent。 岗位职责 一、围绕 AI Agent 架构与 Harness / Loop Engineering / Post-Training / Agentic RL 方向,参与或主导如下工作: 1. AI Agent 架构与 Harness(智能体架构与运行框架) 设计与迭代 AI Agent 架构(Planning / Tool Use / Memory / 多 Agent 协同等),建设工具集、上下文工程、SOP / 知识接入等 Harness,让基座模型的能力在客服场景中充分利用; 2. 推动 Agent 系统提效,通过模型分层、并行调度、上下文压缩与缓存复用等手段,降低端到端时延与推理成本。 二、Loop Engineering(数据与训练自进化闭环) 1. 建设“线上真实反馈(CSAT、转人工、人工改写等)→ 自动评估 → 训练数据生产 → Post-Training / RL → 灰度验证”的自进化闭环,让系统随真实流量持续变强; 2. 以“达到并超越人工客服”为目标,搭建自动化评估与 LLM-as-a-Judge 体系,从离线指标与业务指标共同衡量效果。 三、Post-Training 与 Agentic RL 1. 设计面向客服场景的 SFT / DPO / GRPO / PPO 等后训练策略,基于显式与隐式反馈(用户评分、CSAT、转人工、人工改写等)构造偏好与 Reward 信号; 2. 围绕 Agent 关键决策环节(动作选择、Tool 调用、澄清 / 追问策略等),设计 Agentic RL 目标与训练方法,探索 RLHF / RLAIF 在对话策略中的应用; 四、前沿实践 持续跟进 Post-Training、RL、Agent、Harness / Loop Engineering 等方向的最新研究进展并推动在业务中落地。 任职要求: 1. 计算机科学、人工智能相关专业硕士及以上学历,具有 3–7 年研究 / 工程经验均可; 2. 扎实的计算机与数学基础,良好的算法与数据结构能力; 3. 系统掌握机器学习与深度学习基础理论,对 Transformer 与 LLM 架构有较深入理解; 4. 至少在以下方向中 1–2 个方向具备较深研究或项目经历: -Post-Training(SFT / DPO / GRPO 等); -强化学习 / Agentic RL; -Agent 方向(Planning / Reasoning / Tool Use / Memory / Multi-Agent 等); -Harness / Loop Engineering(Agent 运行框架、自动评估与数据自进化闭环); 5. 熟练掌握 Python,熟悉 PyTorch / TensorFlow 等主流深度学习框架; 6. 具备良好的英文论文阅读与技术沟通能力; 7. 对 研究 + 工程 + 业务 的交叉问题有兴趣,愿意在真实场景中验证和打磨方法。 加分项(优先考虑) 1. 具备国内外一线 AI 团队(OpenAI、Google DeepMind、Anthropic、Meta、字节 Seed、阿里通义、腾讯混元、百度文心等)Agent 或大模型项目经验; 2. 有 AI Agent 系统设计与规模化落地经验,或有 Agent 推理提效(模型蒸馏、模型路由、并行调度、上下文工程等)实践经验; 3. 在 NLP、LLM、RL、Agent 等相关方向于顶会 / 顶刊(如 ACL、EMNLP、NeurIPS、ICLR、ICML 等)有论文产出,或有完整的研究工作; 4. 有实际参与 LLM Post-Training / 强化学习(含 Agentic RL)项目的经验; 5. 有在对话 / 客服 / Agent 场景中开展 RLHF / Agentic RL 的实践经历; 6. 熟悉分布式训练与大模型优化(如 DeepSpeed、FSDP、Megatron 等)。 为什么加入Shopee Sellerbot团队 Sellerbot是每天服务数千万商家、覆盖多个国家与语言的真实 AI Agent 系统。你将面对复杂且具有挑战性的真实业务问题,包括 Tool Learning、长链路任务规划、在线反馈学习、多语言 Agent、业务决策优化等,并有机会将最新的大模型研究成果快速落地到真实产品中,推动 AI Agent 在全球电商场景中的规模化应用
微信扫一扫,及时了解投递状态
您目前还没有登录:立即登录岗位职责: 团队介绍 我们是 Shopee Sellerbot(商家智能客服)团队。 Sellerbot 是 Shopee 面向全球商家的新一代 AI Agent,为数千万商家提供智能客服、运营助手与业务 Agent 服务。 不同于传统 Chatbot,我们希望构建真正能够理解业务、规划任务、调用工具并解决问题的 AI Agent。例如: 查询订单、物流、退款、处罚等业务系统; 自动完成工单处理、运营配置等复杂流程; 理解商家经营情况并提供经营建议; 与人工客服、RM(Relationship Manager)协同工作; 基于真实线上反馈持续学习与自我优化。 团队专注于将 LLM、AI Agent、Post-Training、RL、Tool Learning 等前沿技术应用到真实业务场景,持续推动 Sellerbot 从"回答问题"演进为"帮助商家完成工作"的智能 Agent。 岗位职责 一、围绕 AI Agent 架构与 Harness / Loop Engineering / Post-Training / Agentic RL 方向,参与或主导如下工作: 1. AI Agent 架构与 Harness(智能体架构与运行框架) 设计与迭代 AI Agent 架构(Planning / Tool Use / Memory / 多 Agent 协同等),建设工具集、上下文工程、SOP / 知识接入等 Harness,让基座模型的能力在客服场景中充分利用; 2. 推动 Agent 系统提效,通过模型分层、并行调度、上下文压缩与缓存复用等手段,降低端到端时延与推理成本。 二、Loop Engineering(数据与训练自进化闭环) 1. 建设“线上真实反馈(CSAT、转人工、人工改写等)→ 自动评估 → 训练数据生产 → Post-Training / RL → 灰度验证”的自进化闭环,让系统随真实流量持续变强; 2. 以“达到并超越人工客服”为目标,搭建自动化评估与 LLM-as-a-Judge 体系,从离线指标与业务指标共同衡量效果。 三、Post-Training 与 Agentic RL 1. 设计面向客服场景的 SFT / DPO / GRPO / PPO 等后训练策略,基于显式与隐式反馈(用户评分、CSAT、转人工、人工改写等)构造偏好与 Reward 信号; 2. 围绕 Agent 关键决策环节(动作选择、Tool 调用、澄清 / 追问策略等),设计 Agentic RL 目标与训练方法,探索 RLHF / RLAIF 在对话策略中的应用; 四、前沿实践 持续跟进 Post-Training、RL、Agent、Harness / Loop Engineering 等方向的最新研究进展并推动在业务中落地。 任职要求: 1. 计算机科学、人工智能相关专业硕士及以上学历,具有 3–7 年研究 / 工程经验均可; 2. 扎实的计算机与数学基础,良好的算法与数据结构能力; 3. 系统掌握机器学习与深度学习基础理论,对 Transformer 与 LLM 架构有较深入理解; 4. 至少在以下方向中 1–2 个方向具备较深研究或项目经历: -Post-Training(SFT / DPO / GRPO 等); -强化学习 / Agentic RL; -Agent 方向(Planning / Reasoning / Tool Use / Memory / Multi-Agent 等); -Harness / Loop Engineering(Agent 运行框架、自动评估与数据自进化闭环); 5. 熟练掌握 Python,熟悉 PyTorch / TensorFlow 等主流深度学习框架; 6. 具备良好的英文论文阅读与技术沟通能力; 7. 对 研究 + 工程 + 业务 的交叉问题有兴趣,愿意在真实场景中验证和打磨方法。 加分项(优先考虑) 1. 具备国内外一线 AI 团队(OpenAI、Google DeepMind、Anthropic、Meta、字节 Seed、阿里通义、腾讯混元、百度文心等)Agent 或大模型项目经验; 2. 有 AI Agent 系统设计与规模化落地经验,或有 Agent 推理提效(模型蒸馏、模型路由、并行调度、上下文工程等)实践经验; 3. 在 NLP、LLM、RL、Agent 等相关方向于顶会 / 顶刊(如 ACL、EMNLP、NeurIPS、ICLR、ICML 等)有论文产出,或有完整的研究工作; 4. 有实际参与 LLM Post-Training / 强化学习(含 Agentic RL)项目的经验; 5. 有在对话 / 客服 / Agent 场景中开展 RLHF / Agentic RL 的实践经历; 6. 熟悉分布式训练与大模型优化(如 DeepSpeed、FSDP、Megatron 等)。 为什么加入Shopee Sellerbot团队 Sellerbot是每天服务数千万商家、覆盖多个国家与语言的真实 AI Agent 系统。你将面对复杂且具有挑战性的真实业务问题,包括 Tool Learning、长链路任务规划、在线反馈学习、多语言 Agent、业务决策优化等,并有机会将最新的大模型研究成果快速落地到真实产品中,推动 AI Agent 在全球电商场景中的规模化应用
企业尚未更新
上海市
扫描二维码及时订阅职位
最新职位信息第一时间知晓
上海兼职招聘
360行任你挑选
分秒必争直达HR
谁看我简历早知道
请使用微信【扫一扫】
关注「上海易职邦招聘」公众号完成登录
客服电话:400-765-0056
竭诚为您服务
服务时间08:00-24:00
微信小程序
面试通知
收藏
简历
足迹
微信求职
关注公众号
掌握最新求职动态
小程序
进入小程序
随时随地找工作