职位详情
岗位职责:
1. 多模态生成效果评估: 负责图片生成、视频生成等 AIGC 模型的效果评测工作。结合审美能力与客观准则,对画面的构图布局、质感表现、光影处理,以及视频的运动连贯性、指令符合度进行精准评分与定性解读。
2. 影视级提示词设计: 熟练掌握分镜思维(Shot-by-shot logic),将摄像机角度、镜头运动(如推拉摇移)、灯光情绪及叙事节奏转化为高效、精确的提示语(Prompt),挖掘模型在复杂叙事与艺术表达上的潜力上限。
3. 高质量评测数据建设: 协同产运团队发掘高复杂度、挑战性强的使用场景与Query,标注高质量参考答案,并从专业视角(如物理规律、视觉美学)对典型错误案例进行归因分析。
4. 评测机制持续优化: 参与评测标准(Benchmark)的迭代升级,协助完善图像与视频内容的审美评估框架。
岗位要求:
1. 扎实的视听素养与审美判断力: 具备出色的美学感知力,对摄影技法、色彩搭配、画面构图有敏锐识别能力。了解影视制作工业化流程,能准确捕捉 AI 生成内容中的细节问题(如肢体异常、环境闪烁、动作不自然)。
2. 熟练使用 AIGC 工具:
a. 视频方向: 深度体验过可灵(Kling)、Luma、Runway、Pika 至少一类工具,理解视频生成的技术特性与局限。
b. 图像方向: 熟练操作 nanobanana、Midjourney、Stable Diffusion(WebUI/ComfyUI)或 DALL-E 3,熟悉多种艺术风格的表现特征。
3. 逻辑清晰与表达能力强: 善于将主观审美判断转化为条理清晰、结构完整的反馈文档。
4. 职业态度端正: 工作严谨负责,具备高度的责任意识与时间管理能力,能够胜任长期稳定的评测任务。
加分项:
1. 实践成果与行业影响:
a. 作品积累: 拥有高水平的 AIGC 个人作品集,体现图像美感与视频叙事的高度完成能力。
b. 自媒体经验: 运营过小红书、B站、TikTok 或 Instagram 等平台的 AIGC 相关账号,具备优质内容输出能力,对流行趋势与大众审美有深入理解。
2. 工作流自动化能力: 熟悉 Coze(扣子)、Dify 等平台,有搭建自动评测流程或构建 AI Agent 提升工作效率的实际经验。
3. 技术进阶能力: 掌握 Stable Diffusion(ComfyUI),具备 Lora 训练、ControlNet 精准控制或 AnimateDiff 视频生成的相关实践经验。
4. 编程与语言技能: 具备 Python 基础能力(可用于数据处理或视频脚本编写);或英语水平突出(通过专八 TEM-8)。
1. 多模态生成效果评估: 负责图片生成、视频生成等 AIGC 模型的效果评测工作。结合审美能力与客观准则,对画面的构图布局、质感表现、光影处理,以及视频的运动连贯性、指令符合度进行精准评分与定性解读。
2. 影视级提示词设计: 熟练掌握分镜思维(Shot-by-shot logic),将摄像机角度、镜头运动(如推拉摇移)、灯光情绪及叙事节奏转化为高效、精确的提示语(Prompt),挖掘模型在复杂叙事与艺术表达上的潜力上限。
3. 高质量评测数据建设: 协同产运团队发掘高复杂度、挑战性强的使用场景与Query,标注高质量参考答案,并从专业视角(如物理规律、视觉美学)对典型错误案例进行归因分析。
4. 评测机制持续优化: 参与评测标准(Benchmark)的迭代升级,协助完善图像与视频内容的审美评估框架。
岗位要求:
1. 扎实的视听素养与审美判断力: 具备出色的美学感知力,对摄影技法、色彩搭配、画面构图有敏锐识别能力。了解影视制作工业化流程,能准确捕捉 AI 生成内容中的细节问题(如肢体异常、环境闪烁、动作不自然)。
2. 熟练使用 AIGC 工具:
a. 视频方向: 深度体验过可灵(Kling)、Luma、Runway、Pika 至少一类工具,理解视频生成的技术特性与局限。
b. 图像方向: 熟练操作 nanobanana、Midjourney、Stable Diffusion(WebUI/ComfyUI)或 DALL-E 3,熟悉多种艺术风格的表现特征。
3. 逻辑清晰与表达能力强: 善于将主观审美判断转化为条理清晰、结构完整的反馈文档。
4. 职业态度端正: 工作严谨负责,具备高度的责任意识与时间管理能力,能够胜任长期稳定的评测任务。
加分项:
1. 实践成果与行业影响:
a. 作品积累: 拥有高水平的 AIGC 个人作品集,体现图像美感与视频叙事的高度完成能力。
b. 自媒体经验: 运营过小红书、B站、TikTok 或 Instagram 等平台的 AIGC 相关账号,具备优质内容输出能力,对流行趋势与大众审美有深入理解。
2. 工作流自动化能力: 熟悉 Coze(扣子)、Dify 等平台,有搭建自动评测流程或构建 AI Agent 提升工作效率的实际经验。
3. 技术进阶能力: 掌握 Stable Diffusion(ComfyUI),具备 Lora 训练、ControlNet 精准控制或 AnimateDiff 视频生成的相关实践经验。
4. 编程与语言技能: 具备 Python 基础能力(可用于数据处理或视频脚本编写);或英语水平突出(通过专八 TEM-8)。
2026-02-24 14:35
IP属地:四川成都
职位福利
本科经验不限大模型算法多模态算法图像生成Python

博彦科技(深圳)有限公司
已上市 · 10000人以上

工作地址

鱼泡安全保障
如遇到办证收费、刷单、传销、诱导买车等违规行为,请立即向鱼泡直聘投诉举报投诉举报 >

附近适合您的职位
1.5-2万/月
图像算法3-5年硕士SLAM算法融合感知算法传统图像算法C/C++Python嵌入式开发机器学习
成都 武侯区
1-1.8万/月
图像算法1-3年大专异步编程 TensorRT量化 YOLO目标检测目标跟踪传统图像算法Python图像处理库(OpenCV等)并行计算深度学习大模型算法模型加速/性能优化优秀开源项目经历
成都 武侯区
2-3.5万/月
图像算法3-5年本科留学生优先国内院校优先多模态算法图像生成人像算法目标跟踪Python深度学习机器学习大模型算法发表算法相关优秀论文参加算法相关竞赛/获奖模型加速/性能优化优秀开源项目经历
成都 武侯区










