职位详情
核心职责
1、模型优化:主导大模型技术体系的后训练全流程,涵盖SFT、RLHF、DPO等关键技术环节,聚焦LLM方向,兼顾VLM场景。
2、企业落地:面向企业实际需求,如私有化部署、领域知识融合与推理效率提升,开展模型个性化定制与适配工作。
3、数据与评估:搭建以文本为核心、图像为补充的高质量训练数据集,设计并实施评估机制,支撑模型持续迭代优化。
4、工程实现:完成优化后模型的高效集成与部署,嵌入企业产品流程,确保实际应用中的性能与效果达标。
任职要求
1、统招本科及以上学历,专业方向为计算机科学、人工智能、数学或相关领域。
2、具备2年以上软件开发经验,其中至少1年专注于大模型后训练相关技术实践。
3、熟练掌握SFT、RLHF、DPO、PPO等主流后训练方法的理论基础,能结合具体业务需求进行算法选择与参数调优。
4、拥有完整后训练项目落地经验,覆盖数据准备、方案设计、效果验证及多轮迭代全过程。
5、具备良好的沟通协作能力,逻辑清晰,热衷技术探索,积极参与开源社区建设。
优先条件
1、曾主导或深度参与企业级Agent平台的后训练架构设计与实施。
2、具备构建“数据飞轮”机制并推动模型自动化演进的成功实践经验。
3、在LLM或Agent相关开源项目中担任核心开发者并有实质性贡献。
1、模型优化:主导大模型技术体系的后训练全流程,涵盖SFT、RLHF、DPO等关键技术环节,聚焦LLM方向,兼顾VLM场景。
2、企业落地:面向企业实际需求,如私有化部署、领域知识融合与推理效率提升,开展模型个性化定制与适配工作。
3、数据与评估:搭建以文本为核心、图像为补充的高质量训练数据集,设计并实施评估机制,支撑模型持续迭代优化。
4、工程实现:完成优化后模型的高效集成与部署,嵌入企业产品流程,确保实际应用中的性能与效果达标。
任职要求
1、统招本科及以上学历,专业方向为计算机科学、人工智能、数学或相关领域。
2、具备2年以上软件开发经验,其中至少1年专注于大模型后训练相关技术实践。
3、熟练掌握SFT、RLHF、DPO、PPO等主流后训练方法的理论基础,能结合具体业务需求进行算法选择与参数调优。
4、拥有完整后训练项目落地经验,覆盖数据准备、方案设计、效果验证及多轮迭代全过程。
5、具备良好的沟通协作能力,逻辑清晰,热衷技术探索,积极参与开源社区建设。
优先条件
1、曾主导或深度参与企业级Agent平台的后训练架构设计与实施。
2、具备构建“数据飞轮”机制并推动模型自动化演进的成功实践经验。
3、在LLM或Agent相关开源项目中担任核心开发者并有实质性贡献。
2026-07-17 13:24
IP属地:上海
职位福利
本科10年以上多模态算法大模型算法

盟拓数字科技(苏州)有限公司
A轮 · 500-999人


鱼泡安全保障
如遇到办证收费、刷单、传销、诱导买车等违规行为,请立即向鱼泡直聘投诉举报投诉举报 >









