职位详情
工作描述:
1. 数据工程与训练
- 构建高质量的训练与评估数据集,涵盖测试用例、接口文档、业务规则等金融领域语料的清洗、标注与增强处理。
- 参与模型数据资产体系建设,制定标准化数据规范,推动实现标准数据的自动化筛选与入库流程。
- 参与构建模型评测体系,设计自动化评估指标,持续监控不同模型版本的效果表现。
2. 模型效果调优
- 负责优化测试用例生成、脚本生成、数据生成等核心功能的模型输出质量,提升结果准确性与实用性。
- 针对银行领域的专业术语和业务逻辑进行模型微调(SFT/RLHF),缓解通用大模型在垂直场景中的“幻觉”现象。
3. 工程化落地
- 协同工程团队完成优化后模型的私有化部署与服务封装。
- 监控推理延迟与资源消耗,持续推进模型推理性能优化(如量化、剪枝、vLLM等加速方案)。
4. 前沿探索
- 关注大模型(LLM)、多模态、RAG等前沿技术发展,探索其在测试数据生成、已有资产理解等场景中的创新应用。
技能要求:
1、算法基础
- 具备扎实的机器学习与深度学习理论基础,熟悉BERT、GPT系列模型的核心原理。
- 熟练使用至少一种大模型训练或微调框架。
- 拥有实际的数据清洗、数据增强及模型评估项目经验。
2、编程能力
- 精通Python语言,熟练运用torch、numpy、pandas等主流深度学习库;掌握异步编程与Restful API开发技术;熟悉FastAPI/Django等Web框架。
- 熟悉Linux环境与Git工具,掌握容器化与部署相关技术,了解数据库操作,具备跨平台部署能力。
3、项目经验
- 具备大模型应用开发实践经验,深入理解AI Agent与RAG架构,掌握Prompt工程与模型微调全流程。
4、行业经验
- 有金融或银行领域AI项目经历者优先,具备测试相关知识背景者更佳。
加分项
- 掌握知识库增强生成(RAG)技术体系,包括向量数据库、Embedding模型及RAG调优方法。
- 具备模型量化与推理加速的工程实践经验。
- 有测试工具开发或自动化测试项目背景。
1. 数据工程与训练
- 构建高质量的训练与评估数据集,涵盖测试用例、接口文档、业务规则等金融领域语料的清洗、标注与增强处理。
- 参与模型数据资产体系建设,制定标准化数据规范,推动实现标准数据的自动化筛选与入库流程。
- 参与构建模型评测体系,设计自动化评估指标,持续监控不同模型版本的效果表现。
2. 模型效果调优
- 负责优化测试用例生成、脚本生成、数据生成等核心功能的模型输出质量,提升结果准确性与实用性。
- 针对银行领域的专业术语和业务逻辑进行模型微调(SFT/RLHF),缓解通用大模型在垂直场景中的“幻觉”现象。
3. 工程化落地
- 协同工程团队完成优化后模型的私有化部署与服务封装。
- 监控推理延迟与资源消耗,持续推进模型推理性能优化(如量化、剪枝、vLLM等加速方案)。
4. 前沿探索
- 关注大模型(LLM)、多模态、RAG等前沿技术发展,探索其在测试数据生成、已有资产理解等场景中的创新应用。
技能要求:
1、算法基础
- 具备扎实的机器学习与深度学习理论基础,熟悉BERT、GPT系列模型的核心原理。
- 熟练使用至少一种大模型训练或微调框架。
- 拥有实际的数据清洗、数据增强及模型评估项目经验。
2、编程能力
- 精通Python语言,熟练运用torch、numpy、pandas等主流深度学习库;掌握异步编程与Restful API开发技术;熟悉FastAPI/Django等Web框架。
- 熟悉Linux环境与Git工具,掌握容器化与部署相关技术,了解数据库操作,具备跨平台部署能力。
3、项目经验
- 具备大模型应用开发实践经验,深入理解AI Agent与RAG架构,掌握Prompt工程与模型微调全流程。
4、行业经验
- 有金融或银行领域AI项目经历者优先,具备测试相关知识背景者更佳。
加分项
- 掌握知识库增强生成(RAG)技术体系,包括向量数据库、Embedding模型及RAG调优方法。
- 具备模型量化与推理加速的工程实践经验。
- 有测试工具开发或自动化测试项目背景。
2026-01-12 14:39
IP属地:广东广州
职位福利
硕士经验不限大模型算法

京北方信息技术股份有限公司
已上市 · 10000人以上

工作地址

鱼泡安全保障
如遇到办证收费、刷单、传销、诱导买车等违规行为,请立即向鱼泡直聘投诉举报投诉举报 >

附近适合您的职位
8千-1.2万/月
算法工程师3-5年大专Java团队管理经验图像算法运筹优化算法分布式训练深度学习大模型算法多模态算法大数据处理框架(Spark/Hadoop/Hive)算法工程化经验并行计算优秀开源项目经历SQL
广州 天河区
8千-1.2万/月
算法工程师3-5年大专Java团队管理经验图像算法运筹优化算法分布式训练深度学习大模型算法多模态算法大数据处理框架(Spark/Hadoop/Hive)算法工程化经验并行计算优秀开源项目经历SQL
广州 天河区










