Fingerprint
시니어 사이트 신뢰성 엔지니어 (Senior Site Reliability Engineer)
글로벌 원격 플랫폼의 운영 신뢰성을 책임지며, 관측성·장애 대응·용량 계획·안전한 배포를 통해 서비스 안정성을 높이는 역할입니다.
개발/데이터전세계원격
주요 업무
핵심 프로덕션 시스템의 SLI·SLO와 오류 예산을 운영하고 알림 품질을 개선합니다. 장애 대응과 사후 분석, 부하·성능·용량 분석, 점진적 배포와 자동 롤백, Terraform 인프라 관리, 카오스 테스트, 운영 도구 개발 및 온콜 개선을 수행합니다.
지원 조건
SRE·프로덕션 엔지니어링·인프라·백엔드 경력 6~10년과 실제 프로덕션 시스템 운영 경험이 요구됩니다. SLI/SLO·오류 예산, 고심각도 장애 대응, 분산 시스템 장애 모드, AWS·EKS/Kubernetes·Terraform, Go 또는 Python, Datadog·Prometheus·Grafana·OpenTelemetry, Redis/ElastiCache 경험이 필요합니다. 영어 문서·장애 커뮤니케이션 역량도 요구됩니다.
확인할 점
미국 근무자의 현금 보상 범위만 제시되어 있고 비자 스폰서는 없습니다. 근무 가능 국가 제한과 한국 거주자의 고용 가능 여부는 원문 확인 필요하며 온콜 참여가 포함됩니다.