-
平台工程和技术风险团队负责对内为蚂蚁集团各大业务线提供统一好用的智能工程,技术风险,混合云等产品能力,并且对外发布了智能体开放平台百宝箱、AI 云、Codefu
-
岗位描述:
1. 负责阿里云产品在客户使用场景中的稳定运行,解决运维过程中的疑难问题。
2. 为客户提供阿里云技术咨询服务,根据客户的业务场景和应用目标制定技术
-
岗位职责:
1. 负责公司云原生基础设施的日常运维、架构梳理与稳定性保障,围绕 Kubernetes 集群、边缘计算、服务网格、容器网络、配置管理、监控告警、弹
-
核心职责:
●云原生服务保障: 负责游戏服务的云原生化运维,确保线上游戏7x24小时高可用性、稳定性与安全性,专注于容器化游戏服务的部署、监控、变更与应急响应。
-
Key Accountabilities:
1.负责生产和测试环境中间件可靠性工程建设和优化;
2.负责自动化运维工具编写,提升运维效率和质量;
3.
-
工作职责
1、 负责大规模 AI 集群的计算、网络和存储系统的稳定运行,监控、识别并解决各类线上问题
2、 协助 IDC 和各类软硬件供应商完成大规模集群的部署
-
岗位职责:
负责容器算力平台的设计与开发;
参与构建容器云平台功能,包括镜像仓库、容器集群、容器编排、分布式存储、日志收集、集群监控等;
推动容器云实施、落地、
-
为什么加入我们
1. 离底层最近的网络挑战:支撑大规模 GPU训练与推理集群的容器网络,复杂度与规模远超普通云平台
2. 内核到控制面全链路:从 eB
-
职位描述
1、负责Kubernetes集群的精细化管理,确保集群的高可用性、稳定性和性能;
2、持续优化资源调度策略,利用技术手段提升资源调度效率、资源利用率,
-
云原生高级开发工程师/研发专家 - 容器统一调度与在离线混部方向
地点:北京/上海/杭州
岗位职责
1.负责公司容器调度平台的架构设计和核心功能开发,包括容
-
急招急招!!工作地点:上海美的全球创新园区
一、岗位职责
1. - 负责公司AWS、阿里云等主流云平台的资源运维与管理,包括资源部署、监控告警、性能优化、安全
-
岗位职责
1、负责生产环境云服务器、容器平台以及生产应用的部署、配置、运维、故障排查等;
2、和开发团队一起设计高可用、高可扩展的系统架构;
3、负责参与运维相
-
岗位职责:
1、负责公司生产环境 Kubernetes 集群的部署、维护、监控与故障排查。
2、管理 Linux 服务器系统(如 CentOS、Ubuntu 等
-
【岗位名称】运维工程师
【职位描述】
支持公司内部以及项目的运维工作,确保系统的稳定性、安全性和高效性。与开发团队紧密合作,共同协助项目的顺利交付和持续集成/持
-
岗位职责:
1. 负责通信系统、云服务器、数据库、机房设备、软件及桌面环境的日常故障排查、报警响应、根因定位与解决方案落地,及时恢复服务并完整记录故障处理日
-
运维工程师(互联网产品 / DevOps / SRE / Technical Support)
岗位职责
1.负责互联网产品线上环境稳定性保障:发布变更、容量
-
职位描述:
1.分析业务流程,负责物流分拣相关系统部署配置及迭代维护,培训客户系统操作;
2.负责维护服务器操作系统、数据库、中间件、各类设备的分拣系统软件
-
注:和集团下属人力资源公司签署劳动合同
工作内容:
1. 负责国际车联网云环境资源部署
2. 负责国际车联网各项目业务服务部署
3. 支持国际车联网业务联调
-
岗位职责:
1. 负责OpenStack环境部署、监控、维护及故障处理,保证集群稳定健康运行;
2. 参与自动化运维体系建设,基于Ansible/SaltSta
-
职位描述:
1、开发和维护CI/CD环境(ArgoCD/BitbucketPipeline/Ansible)。
2、与开发团队合作部署和更新系统。(Kuber
-
岗位职责
1. 负责维护服务器、网络设备及操作系统的日常运维与监控,保障系统稳定运行;
2. 执行系统部署、配置管理、故障排查与应急响应,提升服务可用性;
3.
-
【工作地点】合肥
【岗位职责】
1. 负责基础云平台和大数据平台的运维管理工作(部署、监控、优化、故障处理)。
2. 参与设计、实施和维护CI/CD流水线,实现
-
岗位职责
• 安装、配置、维护和升级 Linux 操作系统(包括 RHEL、CentOS、Ubuntu)。
• 管理并支持核心基础设施服务,如 Kickstar
-
核心职责
服务器与基础架构管理:
1. 全面管理物理/虚拟化服务器(以Windows Server为主),包括Active Directory域服务、DNS、D
-
岗位职责:
1. 负责Kubernetes集群的日常运维管理,确保系统稳定运行;
2. 设计和优化Kubernetes集群的架构,提高系统的性能和可靠性;
3.
-
岗位要求:
1、高可用架构部署与优化: 负责设计、部署和维护高可用、可伸缩的服务、器、集群和应用架构,确保服务在面对千万级流量时仍能稳定运行。
2、系统部署与配
-
岗位职责:
负责公司 AI 云业务的多云环境运维与管理,必含 AWS,并至少覆盖腾讯云、阿里云或火山引擎中的一种。
深入理解各云厂商在计算、存储、网络等核心产品
-
岗位职责:
1、负责公司系统的日常运维工作并量化相关指标,及时响应、定位、处理各类生产问题;
2、负责网络、服务器、数据库系统的建设、运维和监控,规划、设计、完
-
职位描述
响应业务方日常运维需求,确保业务系统的稳定运行
负责IDC及阿里云的基础运维工作,包括但不限于服务器管理、网络配置、存储管理等
负责微服务架构的容量管
-
岗位职责:
1. 负责AI短剧平台服务器、数据库、中间件的部署、监控与维护,保障平台高可用、高稳定运行。
2. 负责AI短剧平台的全流程测试,包括功能测试、性能