Jobs
Anthropic 로고

Anthropic

Senior Engineering Manager, Capacity Engineering

경영지원데이터인프라·DevOps

AI 요약

Anthropic의 Capacity Engineering Senior Engineering Manager 포지션으로, 대규모 인프라의 수용량·활용률·비용 효율을 관리하는 데이터/인프라 중심 리더십 역할입니다. Kubernetes, 클라우드, 관측성 스택을 바탕으로 내부 데이터 플랫폼과 계획·보증·효율화 시스템을 운영하며, senior/staff 엔지니어 팀을 이끌고 크로스펑셔널 이해관계자와 정렬합니다.

주요 업무

대규모 용량 엔지니어링 팀 리딩 및 성장 지원, 내부 고객 요구사항 반영과 로드맵 우선순위 설정, 데이터 플랫폼(occupancy/utilization telemetry, billing/usage normalization, BigQuery 테이블 제공) 구축·운영, planning and assurance 시스템(클러스터 헬스, capacity planning, alerting, scheduling/fragmentation 개선) 관리, 효율화 시스템(워크로드별 하드웨어 활용도 측정, benchmarking, baseline 구축) 추진, 설계 리뷰 및 아키텍처 의사결정, SLO/온콜/incident response 운영, 크로스펑셔널 이해관계자와의 정렬 및 리더십 보고.

자격 요건

필수: 소프트웨어 또는 인프라 엔지니어링 팀 관리 경험(시니어 엔지니어 채용, 성과관리, 성장 코칭 포함), 데이터 엔지니어링/인프라/분산시스템/관측성 중 하나 이상의 강한 기술 배경, AWS/GCP/Azure 중 최소 1개와 Kubernetes 기반 인프라, Prometheus/Grafana 등 현대적 observability 스택 이해, 모호하고 자율성이 높은 환경에서 엔지니어링 로드맵을 수립·실행한 경험, 뛰어난 커뮤니케이션 능력, 온콜 및 incident management 포함 운영 책임 수용 가능. 우대: hyperscaler 또는 대규모 ML 환경에서 capacity planning/resource management/FinOps 팀 리딩 경험, GPU/DCGM·TPU utilization 등 accelerator 인프라 이해, multi-cloud billing/telemetry normalization 경험, self-service internal data product 구축 경험, scheduling/packing efficiency/profiling 기반 최적화 경험.

기술 스택

PythonSQLKubernetesBigQueryAWSGCPAzurePrometheusGrafanaDCGMCPUGPUTPU
AI 점수 35AI 운영·지원

Anthropic의 다른 공고

알림

알림이 없습니다