【Python/フルリモート】【業務委託(準委任)】AIアーキテクト/国内最大級エンタメサービスの独自LLMの研究開発、プロダクト化業 の案件・求人
作業内容
独自で開発しているLLMの研究開発〜プロダクト化・サービス運用まで一気通貫で推進していただきます。 大規模サービスによって今まで蓄積してきたデータを活用し、世界に通用するAIを創造するポジションです。 【業務詳細】 ・独自LLMのアーキテクチャ設計・実装 ・各サービス(ゲーム、動画、電子書籍等)データを活用したドメイン適応 ・高速推論基盤の構築・運用、サービス品質管理 ・技術チーム組成・マネジメント、外部パートナー連携 ■作業環境__:Windows/Mac選択可 ★期間:随時~ ★本案件の最新の状況は、担当者までお問合せ下さい。 ※当案件におきましては、直近参画期間が半年以内の案件が続いている方はお見送りとなります。(但し、企業都合退場は対象外) ※20代〜30代が中心で活気ある雰囲気です。 ※成長意欲が高く、スキルを急速に伸ばしたい方に最適 ※将来リーダーを目指す方歓迎 ★面談回数:1回(2回の可能性あり) 【LLMコア技術】 ・Transformer系モデル(GPT、LLaMA等)の実装・改良経験 3年以上 ・PyTorch/TensorFlowでの大規模分散学習(100B+ params)の実務経験 ・CUDA最適化、メモリ効率化、量子化手法の実装経験 ・機械学習の数学的基礎(線形代数、確率統計、最適化理論)の深い理解 【日本語特化技術】 ・日本語トークナイザー設計・最適化経験(SentencePiece、BPE等) ・日本語コーパス構築・前処理パイプラインの開発経験 ・日本語LLM評価指標設計・ベンチマーク実装経験 ・マルチリンガル対応、日英翻訳品質向上の実務経験 【サービス化技術】 ・大規模推論基盤の設計・運用経験(vLLM、TensorRT-LLM等) ・REST API/gRPC設計、レート制限、監視システム構築経験 ・A/Bテスト基盤設計、ユーザー体験最適化の実務経験 ・GPU利用効率化、コスト最適化、オートスケーリング実装経験
必須スキル
【LLMコア技術】 ・Transformer系モデル(GPT、LLaMA等)の実装・改良経験 3年以上 ・PyTorch/TensorFlowでの大規模分散学習(100B+ params)の実務経験 ・CUDA最適化、メモリ効率化、量子化手法の実装経験 ・機械学習の数学的基礎(線形代数、確率統計、最適化理論)の深い理解 【日本語特化技術】 ・日本語トークナイザー設計・最適化経験(SentencePiece、BPE等) ・日本語コーパス構築・前処理パイプラインの開発経験 ・日本語LLM評価指標設計・ベンチマーク実装経験 ・マルチリンガル対応、日英翻訳品質向上の実務経験 【サービス化技術】 ・大規模推論基盤の設計・運用経験(vLLM、TensorRT-LLM等) ・REST API/gRPC設計、レート制限、監視システム構築経験 ・A/Bテスト基盤設計、ユーザー体験最適化の実務経験 ・GPU利用効率化、コスト最適化、オートスケーリング実装経験
稼働条件
週5日稼働必須 / フルリモート
面談回数
1回
契約形態
業務委託(準委任)
開発環境
Python
募集回数
1回
企業名
サービス/プロジェクト名
詳細スケジュール/リリース時期
現場責任者の雰囲気
開発体制の詳細
詳細は面談でお伝えします。ご相談ください。
一部の情報は非公開の場合があります
案件について詳しく聞いてみませんか?
知りたい内容を選んでください(複数選択可)
