职位详情
理想汽车-强化学习算法实习生(长期有效,HC丰富)
岗位职责【强化学习】:
参与Agent-RL强化学习算法的训练优化与数据构建工作,涵盖GUI-Agent、多智能体Agent、search-RLAgent等方向
我们能提供的:
GPU资源充足!!!!
技术积累:深入大模型技术探索,提升攻克复杂技术问题的能力。
实践机会:深度参与实际业务场景的技术落地与系统上线。
成长保障:配备导师全程指导,关注个人发展,与杰出团队共同挑战前沿课题。
我们期待的你:
必备条件:
专业要求:计算机、数学、人工智能等相关专业在读学生,具备统计学或强化学习研究背景者优先;
能力基础:具备扎实的理论基础,熟悉LLM与NLP类算法,掌握Transformer系列模型者优先;
综合素质:积极主动,自我驱动力强,富有创新思维。
加分项:(非必需,潜力更受重视)
实习周期:可保证长期稳定实习,支持持续协作。
学术成果:曾在机器学习顶会发表论文,展现出色科研能力。
项目经历:具有大模型后训练阶段微调等相关实践经验。
工作地点:
北京朝阳望京
岗位职责【强化学习】:
参与Agent-RL强化学习算法的训练优化与数据构建工作,涵盖GUI-Agent、多智能体Agent、search-RLAgent等方向
我们能提供的:
GPU资源充足!!!!
技术积累:深入大模型技术探索,提升攻克复杂技术问题的能力。
实践机会:深度参与实际业务场景的技术落地与系统上线。
成长保障:配备导师全程指导,关注个人发展,与杰出团队共同挑战前沿课题。
我们期待的你:
必备条件:
专业要求:计算机、数学、人工智能等相关专业在读学生,具备统计学或强化学习研究背景者优先;
能力基础:具备扎实的理论基础,熟悉LLM与NLP类算法,掌握Transformer系列模型者优先;
综合素质:积极主动,自我驱动力强,富有创新思维。
加分项:(非必需,潜力更受重视)
实习周期:可保证长期稳定实习,支持持续协作。
学术成果:曾在机器学习顶会发表论文,展现出色科研能力。
项目经历:具有大模型后训练阶段微调等相关实践经验。
工作地点:
北京朝阳望京
2026-09-30 13:12
IP属地:北京
职位福利
硕士经验不限深度学习大模型算法自然语言处理算法强化学习Python

北京理想汽车有限公司
1000-9999人

工作地址

鱼泡安全保障
如遇到办证收费、刷单、传销、诱导买车等违规行为,请立即向鱼泡直聘投诉举报投诉举报 >

附近适合您的职位
2-4万/月
算法工程师3-5年大专团队管理经验图像算法深度学习大模型算法自然语言处理算法算法工程化经验优秀开源项目经历Python
北京 朝阳区
150-300元/天
算法工程师经验不限本科Java图像算法分布式训练深度学习大模型算法自然语言处理算法多模态算法大数据处理框架(Spark/Hadoop/Hive)算法工程化经验广告算法推荐算法发表算法相关优秀论文C/
北京 朝阳区









