职位详情
职位概述:
我们正在招聘一名资深 AI System 系统架构师,负责打造高性能、高可用且具备良好扩展性的 AI 基础设施与系统架构(大模型开发平台/MaaS平台)。你将主导涵盖模型训练、推理部署、数据处理及资源调度等全流程的系统设计,推进 AI 工程化实践,支撑公司在大模型、生成式 AI 及智能应用方向的技术突破与业务发展,并保障内外项目的顺利落地。
主要职责:
1:设计并落地面向大规模 AI 模型(如 LLM、多模态模型等)的端到端系统架构,覆盖训练、微调、推理、监控与运维全生命周期;
2:构建高吞吐、低延迟的 AI 推理服务体系,优化模型部署策略、服务编排机制、弹性伸缩能力与资源成本效率;
3:主导 AI 基础平台(包括训练平台、推理平台、特征平台、向量数据库等)的技术路线规划、架构设计与核心模块实现;
4:协同算法、数据、产品团队,将前沿 AI 能力转化为稳定可靠、易于维护和复用的工程化系统;
5:建立 AI 系统性能评估体系,持续提升系统在响应延迟、处理吞吐、资源利用率和容错能力等方面的表现;
6:关注 AI 系统领域最新技术动态(如分布式训练、模型压缩、推理加速、Serverless AI 等),推动新技术的验证与应用落地。
任职要求:
必备条件:
1、计算机科学、电子工程、自动化或相关专业本科及以上学历;
2、5 年以上后端/系统/平台开发经验,3 年以上从事 AI 系统架构或平台建设相关工作经历;
3、熟练掌握 Python / Java / C++ 中至少一门编程语言,具备扎实的系统级编程与性能调优功底;
4、熟悉主流 AI 框架(如 PyTorch、TensorFlow、JAX)及推理引擎(如 Triton、ONNX Runtime、vLLM、TensorRT);
5、深入理解分布式系统原理、微服务架构、容器化技术(Docker/K8s)、消息队列、缓存机制与数据库系统;
6、具备大规模 GPU 集群运维经验,熟悉模型训练/推理任务调度方案(如 Slurm、Kubernetes + Volcano、Ray 等);
7、拥有良好的系统抽象思维、全局视角以及跨团队协作沟通能力。
加分项:
1、有大模型(LLM)训练或推理系统实际搭建经验;
2、熟悉 MLOps / LLMOps 技术生态(如 MLflow、Kubeflow、LangChain、LlamaIndex 等);
3、参与过开源 AI 系统项目贡献,或发表过技术文章、专利成果;
4、了解模型量化、剪枝、知识蒸馏等模型优化方法;
5、具备云原生 AI 平台(如 AWS SageMaker、Azure ML、GCP Vertex AI)深度使用或定制化开发经验。
我们正在招聘一名资深 AI System 系统架构师,负责打造高性能、高可用且具备良好扩展性的 AI 基础设施与系统架构(大模型开发平台/MaaS平台)。你将主导涵盖模型训练、推理部署、数据处理及资源调度等全流程的系统设计,推进 AI 工程化实践,支撑公司在大模型、生成式 AI 及智能应用方向的技术突破与业务发展,并保障内外项目的顺利落地。
主要职责:
1:设计并落地面向大规模 AI 模型(如 LLM、多模态模型等)的端到端系统架构,覆盖训练、微调、推理、监控与运维全生命周期;
2:构建高吞吐、低延迟的 AI 推理服务体系,优化模型部署策略、服务编排机制、弹性伸缩能力与资源成本效率;
3:主导 AI 基础平台(包括训练平台、推理平台、特征平台、向量数据库等)的技术路线规划、架构设计与核心模块实现;
4:协同算法、数据、产品团队,将前沿 AI 能力转化为稳定可靠、易于维护和复用的工程化系统;
5:建立 AI 系统性能评估体系,持续提升系统在响应延迟、处理吞吐、资源利用率和容错能力等方面的表现;
6:关注 AI 系统领域最新技术动态(如分布式训练、模型压缩、推理加速、Serverless AI 等),推动新技术的验证与应用落地。
任职要求:
必备条件:
1、计算机科学、电子工程、自动化或相关专业本科及以上学历;
2、5 年以上后端/系统/平台开发经验,3 年以上从事 AI 系统架构或平台建设相关工作经历;
3、熟练掌握 Python / Java / C++ 中至少一门编程语言,具备扎实的系统级编程与性能调优功底;
4、熟悉主流 AI 框架(如 PyTorch、TensorFlow、JAX)及推理引擎(如 Triton、ONNX Runtime、vLLM、TensorRT);
5、深入理解分布式系统原理、微服务架构、容器化技术(Docker/K8s)、消息队列、缓存机制与数据库系统;
6、具备大规模 GPU 集群运维经验,熟悉模型训练/推理任务调度方案(如 Slurm、Kubernetes + Volcano、Ray 等);
7、拥有良好的系统抽象思维、全局视角以及跨团队协作沟通能力。
加分项:
1、有大模型(LLM)训练或推理系统实际搭建经验;
2、熟悉 MLOps / LLMOps 技术生态(如 MLflow、Kubeflow、LangChain、LlamaIndex 等);
3、参与过开源 AI 系统项目贡献,或发表过技术文章、专利成果;
4、了解模型量化、剪枝、知识蒸馏等模型优化方法;
5、具备云原生 AI 平台(如 AWS SageMaker、Azure ML、GCP Vertex AI)深度使用或定制化开发经验。
2026-08-20 15:06
IP属地:四川成都
职位福利
本科5-10年JavaPython微服务架构容器技术分布式技术平台架构云计算架构

中电信人工智能科技(北京)有限公司
不需要融资 · 1000-9999人

工作地址

鱼泡安全保障
如遇到办证收费、刷单、传销、诱导买车等违规行为,请立即向鱼泡直聘投诉举报投诉举报 >











