WME 正在打造下一代内部平台,以支持全球领先的娱乐公司之一。
我们正在寻找一位高级 DevOps 工程师,能够设计云基础设施并提升系统可靠性。我们构建的软件可帮助代理机构与团队在全球娱乐行业中管理关系、交易和机会——因此,所有系统必须保持快速、高可用,并具备完整可观测性。
你将对基础设施与可靠性路线图承担端到端责任:部署云资源、维护 Kubernetes 部署、改进 CI/CD 流水线,并构建可观测性能力,帮助工程师更有信心地交付。我们正在从旧系统进行积极迁移,因此你将参与新平台的建设,并在我们以模块为单位逐步切换的过程中推动过渡工作。
我们正从零开始组建大量工程团队。如果你喜欢从零搭建基础设施的工作,对平台应如何构建有明确且坚定的看法,并希望影响团队的软件交付方式,那么这个岗位非常适合你。
你可能会参与的示例问题:
– 设计并维护运行我们 gRPC 微服务和 Next.js Web 应用的 Azure 基础设施
– 构建可观测性能力,能够让分布式系统中的服务健康状况、延迟以及故障模式一目了然
– 改进 CI/CD 流水线,使部署更快、更安全、并实现全自动
– 大规模运维 PostgreSQL,包括备份、故障转移、迁移与性能优化
– 支持将多个服务从传统的 .NET/MSSQL 平台迁移到现代的云原生架构
– 创建开发者工具,降低摩擦并保持团队持续高效推进
你将做的工作:
– 使用 Terraform 拥有并持续演进 Azure 基础设施,包括网络、计算、托管服务与密钥
– 管理 Kubernetes 集群,并为分布式微服务提供基于 Helm 的部署
– 构建并维护 CI/CD 流水线(GitHub Actions / Azure DevOps),以确保部署快速、可靠
– 定义并改进各服务的可观测性体系,包括指标、日志、告警与链路追踪
– 牵头事故响应,推动问题解决、撰写复盘报告,并确保可靠性改进落到实处
– 管理 PostgreSQL 基础设施,包括备份、复制、故障转移与查询性能
– 与工程师协作,改进本地开发环境与部署流程
– 应用安全最佳实践,包括密钥管理、网络策略、访问控制与漏洞扫描
我们在寻找:
– 扎实的 DevOps 或平台工程经验,通常 5 年以上
– 有实际使用 Azure 的经验(AKS、Azure AD、托管数据库、Blob 存储、网络等)
– Terraform 经验:能够在规模化场景下编写、组织与维护基础设施即代码(IaC)
– Kubernetes 与 Helm 经验:能够在生产环境中运行工作负载
– 有构建与运行 CI/CD 流水线的经验(GitHub Actions、Azure DevOps 或类似方案)
– PostgreSQL 经验:运维管理、迁移与性能调优
– 对可观测性工具有深入了解(Datadog、Grafana、OpenTelemetry 或等同工具)
– 有事故响应经验,并能够通过复盘报告推动可靠性改进
– 有 Docker 以及容器镜像管理经验
– 熟悉密钥管理工具(Azure Key Vault、Vault 或等同方案)
– 能够适应系统与流程仍在演进的工作环境
我们的工作方式:
– 提供可落地的解决方案,解决真实问题
– 更偏好简单且可维护的架构
– 与工程、产品与设计团队紧密协作
– 使用现代云基础设施(AWS / Azure)、Terraform 以及容器化部署
– 通过自动化 CI/CD 流水线保持发布快速且安全
– 在整个工程工作流程中使用 AI 辅助开发
以下薪酬区间反映了该职位目前的招聘范围,基于当地要求,并出于透明度考虑。薪酬取决于多个因素,包括所在地,并可能随与岗位相关的资质、知识、技能和经验而有所不同。WME 致力于提供在当地具有竞争力的薪酬方案,可能包括基本薪资以及适用的短期与长期激励、成长与发展机会,以及全面的福利(包括医疗、退休金、带薪假期和其他有薪休假),并提供其他额外福利。
招聘薪资最低:每年 131,250 美元
招聘薪资最高:每年 175,000 美元
WME 是平等机会雇主,鼓励符合条件的候选人申请,不因性别、 race(种族)、残障、年龄、性取向、宗教或信仰而有所区别。
To apply for this job, please visit the application page

