【エンド直】次世代GPUクラウド基盤におけるSRE(Site Reliability Engineering)支援_S0052

掲載終了4ヶ月前

【エンド直】次世代GPUクラウド基盤におけるSRE(Site Reliability Engineering)支援_S0052

5,000〜9,000/時

作業内容

S0052 【案件名】 次世代GPUクラウド基盤におけるSRE(Site Reliability Engineering)支援 【業務内容】 ・監視/ログ基盤の設計・構築(Prometheus, Grafana等) ・Infrastructure as Code (IaC) を用いたプロビジョニングの自動化 ・障害時の自動フェイルオーバーおよび復旧フローの設計 ・SLO/SLIの策定および可観測性(Observability)の向上 ・CI/CDパイプラインの構築・整備 ・資産管理、構成管理の標準化と自動化 【必須スキル】 ・SREまたはインフラ運用設計の実務経験 ・Kubernetes環境でのシステム構築・運用経験 ・Terraform、Ansible等のIaCツールを用いた自動化経験 【歓迎スキル】 ・大規模システムの負荷対策、パフォーマンス検証経験 ・ネットワーク、セキュリティを含めた統合的な障害切り分け能力 ・SLA/SLOに基づくサービス運用プロセスの構築経験 【時期】 即日 【単価】 スキル見合い 【面談】 1〜2回 【最寄】 内幸町(リモート併用) 【その他】 ・PC支給あり ・募集人数:複数名 ・最新のGPUインフラを支える高度なSRE業務です ・参画時には契約社員化または社員化が必須となります

稼働条件

週5日 / 一部リモート

契約形態

業務委託(フリーランス)

開発環境

GPU、SRE、インフラ

募集回数

1回

職種・ポジション

スキル

企業名

株式会社itoq

サービス/プロジェクト名

詳細スケジュール/リリース時期

現場責任者の雰囲気

開発体制の詳細

詳細は面談でお伝えします。ご相談ください。

一部の情報は非公開の場合があります

案件について詳しく聞いてみませんか?

知りたい内容を選んでください(複数選択可)

スキルで絞り込む
都道府県で絞り込む