掲載終了4ヶ月前
【エンド直】次世代GPUクラウド基盤におけるSRE(Site Reliability Engineering)支援_S0052
5,000〜9,000/時
作業内容
S0052 【案件名】 次世代GPUクラウド基盤におけるSRE(Site Reliability Engineering)支援 【業務内容】 ・監視/ログ基盤の設計・構築(Prometheus, Grafana等) ・Infrastructure as Code (IaC) を用いたプロビジョニングの自動化 ・障害時の自動フェイルオーバーおよび復旧フローの設計 ・SLO/SLIの策定および可観測性(Observability)の向上 ・CI/CDパイプラインの構築・整備 ・資産管理、構成管理の標準化と自動化 【必須スキル】 ・SREまたはインフラ運用設計の実務経験 ・Kubernetes環境でのシステム構築・運用経験 ・Terraform、Ansible等のIaCツールを用いた自動化経験 【歓迎スキル】 ・大規模システムの負荷対策、パフォーマンス検証経験 ・ネットワーク、セキュリティを含めた統合的な障害切り分け能力 ・SLA/SLOに基づくサービス運用プロセスの構築経験 【時期】 即日 【単価】 スキル見合い 【面談】 1〜2回 【最寄】 内幸町(リモート併用) 【その他】 ・PC支給あり ・募集人数:複数名 ・最新のGPUインフラを支える高度なSRE業務です ・参画時には契約社員化または社員化が必須となります
稼働条件
週5日 / 一部リモート
契約形態
業務委託(フリーランス)
開発環境
GPU、SRE、インフラ
募集回数
1回
職種・ポジション
スキル
企業名
株式会社itoq
サービス/プロジェクト名
詳細スケジュール/リリース時期
現場責任者の雰囲気
開発体制の詳細
詳細は面談でお伝えします。ご相談ください。
一部の情報は非公開の場合があります
3件以上の応募でご希望の条件の案件に参画しやすくなります
人気案件は申し込みが集中します。ご相談はお早めに!
案件について詳しく聞いてみませんか?
知りたい内容を選んでください(複数選択可)
