职位详情
职位描述:
凭借扎实的编程能力与高效的学习能力,迅速掌握主流评测工程框架,准确识别并定位评估跑分中的问题根源,能有效排查评测数据偏差、用例逻辑缺陷、平台适配异常等情况。协同研发团队推进问题修复,确保评测集的高质量交付;
具备一定创新意识,针对评测集建设中人工介入较多、易产生误差的环节,通过编写自动化脚本实现关键流程提效,例如自动化数据清洗、批量校验等操作;
关注大模型领域前沿进展,熟悉agent/tooluse等主流评测方向,理解其技术原理与实际应用场景;掌握大语言模型训练各阶段的基础理论(如pretrain/sft/rl)及相关数据形态特征;
职位要求:
本科及以上学历,计算机科学、人工智能、软件工程、数据科学等相关专业优先;
具备坚实的计算机基础:能够结合AI工具高效完成代码开发与源码调试,熟练使用Python,并掌握与其他语言(如go、java、javascript)交互的能力,拥有跨语言开发实践经验;
具备快速掌握新技术、新框架及行业趋势的能力,可在1-2周内完成环境熟悉并独立开展工作;
熟悉大模型常见的评估流程与指标体系,适应大模型技术快速演进的工作节奏;有良好的总结沉淀习惯,能将分散的业务信息进行系统化梳理;
乐于分享并持续追求效率提升,善于利用AI工具优化自身及团队工作流程,对重复性高、易出错的人工环节,能通过自动化脚本实现流程升级,如数据清洗、批量校验等。
凭借扎实的编程能力与高效的学习能力,迅速掌握主流评测工程框架,准确识别并定位评估跑分中的问题根源,能有效排查评测数据偏差、用例逻辑缺陷、平台适配异常等情况。协同研发团队推进问题修复,确保评测集的高质量交付;
具备一定创新意识,针对评测集建设中人工介入较多、易产生误差的环节,通过编写自动化脚本实现关键流程提效,例如自动化数据清洗、批量校验等操作;
关注大模型领域前沿进展,熟悉agent/tooluse等主流评测方向,理解其技术原理与实际应用场景;掌握大语言模型训练各阶段的基础理论(如pretrain/sft/rl)及相关数据形态特征;
职位要求:
本科及以上学历,计算机科学、人工智能、软件工程、数据科学等相关专业优先;
具备坚实的计算机基础:能够结合AI工具高效完成代码开发与源码调试,熟练使用Python,并掌握与其他语言(如go、java、javascript)交互的能力,拥有跨语言开发实践经验;
具备快速掌握新技术、新框架及行业趋势的能力,可在1-2周内完成环境熟悉并独立开展工作;
熟悉大模型常见的评估流程与指标体系,适应大模型技术快速演进的工作节奏;有良好的总结沉淀习惯,能将分散的业务信息进行系统化梳理;
乐于分享并持续追求效率提升,善于利用AI工具优化自身及团队工作流程,对重复性高、易出错的人工环节,能通过自动化脚本实现流程升级,如数据清洗、批量校验等。
2025-12-11 06:24
IP属地:四川成都
职位福利
本科1-3年AI训练大模型训练PythonLLMNLP

北京软通动力云计算科技服务有限公司
未融资 · 10000人以上

工作地址

鱼泡安全保障
如遇到办证收费、刷单、传销、诱导买车等违规行为,请立即向鱼泡直聘投诉举报投诉举报 >












