职位详情
岗位要求:
● 本科及以上学历,专业不限。
● 具备较强的文字理解与表达能力,逻辑清晰,富有同理心,能够从用户角度思考问题。
● 工作态度严谨、细致负责,执行力强,具备良好的团队合作意识,能严格执行评测规范与操作流程。
● 掌握基础的计算机操作,熟练运用常用办公软件(如Excel、Word),有数据标注或模型评估相关经验者更佳。
● 对人工智能及大语言模型领域有兴趣,长期使用主流AI工具,并有一定认知与思考;熟悉大模型的基本技术原理与架构。
岗位职责:
● 承担大语言模型(LLM)各项通用能力的实测评估工作,涵盖文本生成、逻辑推理、知识问答、多轮对话、代码生成等核心场景的效果检验。
● 依据既定标准和流程,对模型输出进行准确评分与标注,记录测试中出现的异常现象与模型缺陷,形成完整详实的评测日志。
● 参与自动化评估体系的建设,完成题目设计、考点说明、评分规则制定等相关任务。
● 协助开展评测数据集的整理、清洗与标注,提升样本覆盖范围与代表性,保障评测数据质量。
● 配合团队推进评测任务执行,及时反馈评测过程中发现的问题(如标准不明确、样本异常等),共同完善评测方案与流程。
● 本科及以上学历,专业不限。
● 具备较强的文字理解与表达能力,逻辑清晰,富有同理心,能够从用户角度思考问题。
● 工作态度严谨、细致负责,执行力强,具备良好的团队合作意识,能严格执行评测规范与操作流程。
● 掌握基础的计算机操作,熟练运用常用办公软件(如Excel、Word),有数据标注或模型评估相关经验者更佳。
● 对人工智能及大语言模型领域有兴趣,长期使用主流AI工具,并有一定认知与思考;熟悉大模型的基本技术原理与架构。
岗位职责:
● 承担大语言模型(LLM)各项通用能力的实测评估工作,涵盖文本生成、逻辑推理、知识问答、多轮对话、代码生成等核心场景的效果检验。
● 依据既定标准和流程,对模型输出进行准确评分与标注,记录测试中出现的异常现象与模型缺陷,形成完整详实的评测日志。
● 参与自动化评估体系的建设,完成题目设计、考点说明、评分规则制定等相关任务。
● 协助开展评测数据集的整理、清洗与标注,提升样本覆盖范围与代表性,保障评测数据质量。
● 配合团队推进评测任务执行,及时反馈评测过程中发现的问题(如标准不明确、样本异常等),共同完善评测方案与流程。
2026-01-31 09:22
IP属地:四川成都
职位福利
本科1-3年编辑文案

博彦科技(深圳)有限公司
已上市 · 10000人以上


鱼泡安全保障
如遇到办证收费、刷单、传销、诱导买车等违规行为,请立即向鱼泡直聘投诉举报投诉举报 >

附近适合您的职位
2-6千/月
兼职文案编辑经验不限学历不限居家办公接受居家办公新媒体文案10w+阅读网感好超高点赞快速涨粉会视频后期
成都 武侯区 成都南站
5-7千/月
文案编辑经验不限本科融资产业政策AI医疗/制药/合成生物公众号运营科技行业弹性工作制不接受居家办公新媒体文案
成都 武侯区











