【GPUインフラ/AWS/リモート併用/週5日】音声AIプラットフォームの推論基盤構築エンジニア
作業内容
音声AIモデル(認識・合成)を展開する急成長中のスタートアップにて、プロダクトの根幹を支える大規模な計算基盤の構築・運用を主導していただきます。 現在はエンタープライズ向けサービスの拡大に伴い、マルチクラウド(AWS / GCP / Azure / AliCloud等)を横断したGPUインフラの設計・構築がメインミッションです。 具体的には、Kubernetesを用いたスケーラブルな推論基盤の構築、AIモデルのデプロイ自動化(CI/CD)、および高額なGPUコストの分析・最適化に向けた検証などを担当いただきます。 アジア発のグローバル展開を見据える熱量の高いチームで、膨大な計算リソースを効率的に運用する最先端のエンジニアリングに携わることができます。 <主な業務> ・マルチクラウド上でのGPU計算リソースの設計・構築・保守 ・Kubernetesを用いた音声AI推論基盤の構築・運用 ・AIモデルのサービング環境構築(API化・更新フローの自動化) ・GPUコストの分析・最適化、およびクラウド間での構成比較・検証 ・複数クラウドを横断したインフラプラットフォームの運用
必須スキル
リモート併用 ・主要クラウド(AWS, GCP, Azure等)におけるインフラ構築経験(3年以上) ・コンテナ環境(Kubernetes)を用いたインフラ運用経験 ・インフラ環境への機械学習モデル等のデプロイ、または運用に関わる知見
歓迎スキル
・マルチクラウド環境の横断的な運用経験 ・大規模なGPUリソースのコスト最適化やパフォーマンスチューニングの経験 ・CI/CDパイプラインの構築・運用経験 ・スタートアップでのスピード感を持った開発経験
稼働条件
週5日 / 一部リモート可
面談回数
1回
契約形態
業務委託(フリーランス)
開発環境
- インフラ:AWS, GCP, Azure, AliCloud - 技術:Kubernetes, Docker, GPUインスタンス - CI/CD:GitHub Actions 等 - ツール:Slack, Notion 等 AWS、Microsoft Azure、Google Cloud Platform(GCP)、GitHub、Docker、Kubernetes
作業時間
10:00-19:00
精算基準時間
140h〜180h
募集回数
1回
企業名
サービス/プロジェクト名
詳細スケジュール/リリース時期
現場責任者の雰囲気
開発体制の詳細
詳細は面談でお伝えします。ご相談ください。
一部の情報は非公開の場合があります
案件について詳しく聞いてみませんか?
知りたい内容を選んでください(複数選択可)
