【フルリモート/週5/AWS】コンテナ基盤(EKS)を中心とした大規模SaaSプロダクトのSRE案件

掲載終了2ヶ月前

【フルリモート/週5/AWS】コンテナ基盤(EKS)を中心とした大規模SaaSプロダクトのSRE案件

4,000〜5,500/時

作業内容

お任せしたいこと [役割] SRE(Site Reliability Engineer)として、AWS上に構築された大規模SaaSプロダクトのコンテナ基盤(EKS)の運用、監視体制の強化、および信頼性向上を担っていただきます。 [役割に対して求める成果] Datadogを用いたオブザーバビリティの向上と、Terraformによるインフラコード化(IaC)を進めることで、システムの障害検知から復旧までの時間を短縮し、SLOを実数値として担保すること。 具体的な業務内容 Amazon EKS(Kubernetes)環境の運用、クラスタアップデート、およびマニフェストの最適化 Terraformを用いたAWSリソース(VPC、EC2、RDS、EKS等)の構成管理とコード化の推進 Datadogを活用したシステム監視、ログ集約、およびアラート定義の設計・チューニング GitHub Actionsを用いたCI/CDパイプラインの構築・改修による、デプロイプロセスの自動化 本番環境での障害発生時における原因究明、トラブルシューティング、および再発防止策の策定 アプリケーション開発チームと連携した、アーキテクチャの改善提案や負荷対策の実施 必須スキル・経験 AWS(VPC、EC2、RDS、IAM等)を用いたクラウドインフラの構築・運用実務経験3年以上 Kubernetes(EKS等)を用いたコンテナ環境の商用運用経験1年以上 Terraformを用いたInfrastructure as Code(IaC)の実務における実用経験 Datadog、Prometheus、Grafanaなどのツールを用いた監視環境の構築・運用経験 Linuxサーバーの設計・構築、およびシェルスクリプトを用いた簡単な運用自動化スキル 歓迎スキル・経験 GitHub ActionsやCircleCIを用いた、モバイル・WebアプリのCI/CD構築・運用経験 PythonやGoを用いた、インフラ運用・自動化ツールの開発実務経験 大規模トラフィック下での負荷テストの実施、およびパフォーマンスチューニングの経験 AWS認定ソリューションアーキテクト(SAP)などの上位資格の保持 ISMSやセキュリティ基準に準拠したセキュアなインフラ構築・監査対応の経験 開発環境 クラウド:AWS (EKS, EC2, RDS, Lambda, S3, CloudFront) IaC・CI/CD:Terraform, GitHub Actions, Helm 監視・ログ:Datadog, AWS CloudWatch OS・管理:Linux (Amazon Linux/Ubuntu), Docker, GitHub, Slack, Jira 開発チームについて 現在はSRE専任のエンジニアが3名在籍しており、各プロダクトチームと横断的に連携しています。 「手作業をゼロにする」という強い意志を持ったチームで、新しいツールの検証や自動化の提案が非常に通りやすいフラットな環境です。 求める人物像 アプリケーションの構造まで踏み込んで、システム全体の信頼性を総合的に向上させたい方 トラブル発生時にも冷静にログを追いかけ、論理的に原因を特定できる方 仕事の魅力 国内屈指の規模を誇るSaaSのインフラ基盤に携わり、高度なSREスキルを実践・習得できます。 フルリモート環境ながらも、技術的な議論が盛んで、心理的安全性高くチャレンジできる現場です。 働き方 リモート環境 [フルリモート] フルリモートで働いていただけます。

稼働条件

週5日 / フルリモート

契約形態

業務委託(フリーランス)

開発環境

AWS、EKS、SRE、Terraform

募集回数

1回

職種・ポジション

スキル

バックエンド:
ビジネスツール・コミュニケーション:

企業名

株式会社Kaizen Tech Agent

サービス/プロジェクト名

詳細スケジュール/リリース時期

現場責任者の雰囲気

開発体制の詳細

詳細は面談でお伝えします。ご相談ください。

一部の情報は非公開の場合があります

案件について詳しく聞いてみませんか?

知りたい内容を選んでください(複数選択可)