职位详情
岗位职责:
1、开展基于大语言模型的智能体(Agent)系统研发与性能优化,构建训练流程、环境交互逻辑及奖励机制等关键模块,推进Agent在商业应用中的实际部署;
2、牵头Multi-Agent框架的技术开发,覆盖AgenticRPA、AgenticRAG等方向,探索其在营销服务等多任务场景下的技术落地路径;
3、设计并实施结合强化学习(RL)的智能体后训练优化策略,融合知识图谱技术,提升模型在商家运营建议、销售对话等场景中的表现力;
4、优化大模型微调(SFT、RLHF等)、检索增强生成(RAG)等技术链路,增强Agent在工具调用、交互式查询等场景下的响应能力;
5、构建智能体效果评估体系,制定奖励函数与评价指标,量化Agent在销售对话等业务环节中的执行成效;
6、紧跟Agent与强化学习领域的最新进展,协同团队推动技术突破,并将研究成果有效转化为产品功能
任职要求
1、计算机科学、人工智能、数理统计等相关专业硕士及以上学位;
2、具备扎实的大语言模型(LLM)理论基础,熟练掌握主流大模型的应用方法(如DeepSeek、GPT、LLaMA、GLM等);
3、拥有深厚的强化学习背景,熟悉PPO、GRPO等典型算法,具备基于LLM的大规模强化学习训练经历;
4、精通大模型后训练相关技术,包括微调、量化、模型蒸馏、推理加速等,有垂直领域模型调优经验者优先;
5、了解Agent系统整体架构,掌握多智能体协同、任务调度、工具使用、最优路径规划、MCP协议等核心技术;
6、具备将AI能力与实际业务融合的能力,可针对商家经营、销售对话等场景设计并落地智能化解决方案;
7、具有良好的算法设计与编码能力,熟练使用Python,掌握PyTorch等深度学习框架;
8、具备较强的研究素养,能高效阅读并复现前沿论文,在顶级国际会议发表过相关成果者优先
加分项
1、具有电商或SaaS领域AI应用背景,理解商家运营与销售流程的核心需求;
2、在知识图谱与大模型融合方面有研究或项目实践经验;
3、参与过AIAgent在真实业务环境中的落地实施项目;
4、具备产品意识,能够从实际业务需求出发进行技术方案设计
1、开展基于大语言模型的智能体(Agent)系统研发与性能优化,构建训练流程、环境交互逻辑及奖励机制等关键模块,推进Agent在商业应用中的实际部署;
2、牵头Multi-Agent框架的技术开发,覆盖AgenticRPA、AgenticRAG等方向,探索其在营销服务等多任务场景下的技术落地路径;
3、设计并实施结合强化学习(RL)的智能体后训练优化策略,融合知识图谱技术,提升模型在商家运营建议、销售对话等场景中的表现力;
4、优化大模型微调(SFT、RLHF等)、检索增强生成(RAG)等技术链路,增强Agent在工具调用、交互式查询等场景下的响应能力;
5、构建智能体效果评估体系,制定奖励函数与评价指标,量化Agent在销售对话等业务环节中的执行成效;
6、紧跟Agent与强化学习领域的最新进展,协同团队推动技术突破,并将研究成果有效转化为产品功能
任职要求
1、计算机科学、人工智能、数理统计等相关专业硕士及以上学位;
2、具备扎实的大语言模型(LLM)理论基础,熟练掌握主流大模型的应用方法(如DeepSeek、GPT、LLaMA、GLM等);
3、拥有深厚的强化学习背景,熟悉PPO、GRPO等典型算法,具备基于LLM的大规模强化学习训练经历;
4、精通大模型后训练相关技术,包括微调、量化、模型蒸馏、推理加速等,有垂直领域模型调优经验者优先;
5、了解Agent系统整体架构,掌握多智能体协同、任务调度、工具使用、最优路径规划、MCP协议等核心技术;
6、具备将AI能力与实际业务融合的能力,可针对商家经营、销售对话等场景设计并落地智能化解决方案;
7、具有良好的算法设计与编码能力,熟练使用Python,掌握PyTorch等深度学习框架;
8、具备较强的研究素养,能高效阅读并复现前沿论文,在顶级国际会议发表过相关成果者优先
加分项
1、具有电商或SaaS领域AI应用背景,理解商家运营与销售流程的核心需求;
2、在知识图谱与大模型融合方面有研究或项目实践经验;
3、参与过AIAgent在真实业务环境中的落地实施项目;
4、具备产品意识,能够从实际业务需求出发进行技术方案设计
2026-07-19 13:24
IP属地:四川成都
职位福利
硕士3-5年检索增强(RAG)大语言模型(LLM)DeepSeek、GPTSFT训练、RLHFPyTorch、RL推理加速智能体(Agent)系统LLaMA、GLM微调、量化、模型蒸馏

四川中仑数科科技有限责任公司
不需要融资 · 100-499人

工作地址

鱼泡安全保障
如遇到办证收费、刷单、传销、诱导买车等违规行为,请立即向鱼泡直聘投诉举报投诉举报 >











