×
Register Here to Apply for Jobs or Post Jobs. X

フルリモート/週】AWS SRE(サイトリライアビリティエンジニア・システム信頼性向上

Job in Yonkers, Westchester County, New York, 10701, USA
Listing for: TechDirect
Full Time position
Listed on 2026-10-04
Job specializations:
  • IT/Tech
    AWS, Cloud Computing: Infrastructure & Operations, SRE/Site Reliability, Systems Engineer
Salary/Wage Range or Industry Benchmark: 120000 - 180000 USD Yearly USD 120000.00 180000.00 YEAR
Job Description & How to Apply Below
【フルリモート/週5】AWS SRE(サイトリライアビリティエンジニア・システム信頼性向上)お任せしたいこと

自社で展開するWebサービス、またはエンタープライズ向けのシステムにおいて、AWSを中心としたクラウドインフラの信頼性(Reliability)向上と運用自動化を担うSRE業務をお任せします。SLI/SLOの策定を通じたサービスレベルの管理や、トイル(手作業の運用業務)の削減、CI/CDパイプラインの高度化など、ソフトウェアエンジニアリングのアプローチを用いてインフラ運用の課題を解決していただくポジションです。

具体的な業務内容
  • AWSを利用した高可用性かつスケーラブルなインフラアーキテクチャの設計・構築
  • 開発チームと連携したSLI/SLOの策定、およびエラーバジェットの運用・管理
  • Terraform、AWS CDK等を用いたインフラコード化(IaC)の推進と運用基盤の改善
  • DatadogやNew Relic、Amazon Cloud Watchを用いた監視ダッシュボードの構築およびアラート最適化
  • 障害発生時のインシデント対応、ポストモーテム(事後検証)の実施、および恒久的な再発防止策の実装
  • Git Hub Actions等を活用したCI/CDパイプラインの構築、デプロイプロセスの自動化・高速化
  • システムパフォーマンスのボトルネック特定およびアプリケーションエンジニアと連携したチューニング
必須スキル・経験
  • AWSを利用したシステムの設計・構築・運用実務経験(目安として3年以上)
  • Terraform、AWS CDK、Ansible等を用いたIaC(Infrastructure as Code)の運用経験
  • Linux環境におけるサーバー運用、およびTCP/IPなどネットワークの基礎知識
  • Git / Git Hub等を用いたチーム開発経験、およびCI/CDパイプラインの構築経験
  • システムの監視設計、および障害対応の実務経験
歓迎スキル・経験
  • SRE(Site Reliability Engineering)のプラクティスに基づいた実務経験
  • Go、Python、Node.jsなどの言語を用いた運用ツールやAPIの開発経験
  • Docker、Kubernetes(Amazon EKS等)を利用したコンテナオーケストレーションの運用経験
  • 大規模トラフィックを扱うWebサービスのインフラ設計、またはパフォーマンスチューニング経験
  • AWS認定資格(Sys Ops Administrator、Dev Ops Engineer Professionalなど)
開発・業務環境
  • クラウド:AWS (EC2, ECS, EKS, RDS, Elasti Cache, Lambda, Cloud Front等)
  • IaC・構成管理:Terraform, AWS CDK
  • CI/CD:Git Hub Actions, AWS Code Pipeline
  • 監視・可観測性:Datadog, New Relic, Amazon Cloud Watch, Pager Duty
  • OS・コンテナ:Linux, Docker, Kubernetes
  • コミュニケーション・管理:Git Hub, Jira, Slack, Zoom, Notion
プロジェクトチームについて

「インフラ担当」という枠にとどまらず、開発チームと協調してプロダクトの価値を最大化することをミッションとするチームです。

手作業による運用(トイル)を徹底的に嫌い、エンジニアリングによって仕組みを改善していくカルチャーが根付いています。障害が発生した際も「誰がやったか」ではなく「なぜ起きたか」「どう防ぐか」にフォーカスするブレームレスな環境を重視しています。

求める人物像
  • システムの安定性と開発スピードのトレードオフを理解し、データ(SLI/SLO等)に基づいた意思決定ができる方
  • 日々の定常作業を自動化・効率化することに喜びを感じる方
  • インフラレイヤーだけでなく、アプリケーションの挙動にも関心を持ち、開発チームと円滑なコミュニケーションが取れる方
  • 新しいクラウド技術やSREのプラクティスを継続的に学習し、実務に還元できる方
働き方リモート環境

[フルリモート] 基本的にフルリモートで働いていただけます。

The 【フルリモート/週5】AWS SRE(サイトリライアビリティエンジニア・システム信頼性向…

To View & Apply for jobs on this site that accept applications from your location or country, tap the button below to make a Search.
(If this job is in fact in your jurisdiction, then you may be using a Proxy or VPN to access this site, and to progress further, you should change your connectivity to another mobile device or PC).
 
 
 
Search for further Jobs Here:
(Try combinations for better Results! Or enter less keywords for broader Results)
Location
Increase/decrease your Search Radius (miles)
0
200
Filters
Education Level
Experience Level (years)
Posted in last:
Salary