募集要項
- 募集背景
- 非公開情報も含むため、詳しくは求人紹介時に担当コンサルタントよりご案内いたします。
- 仕事内容
-
IT系プロジェクトマネージャーのご経験のある方は歓迎です。◆業務概要
GPUクラウド基盤の企画・設計・構築・運用まで、Sier等外部パートナーとの連携を通じて進め、品質の高いサービス開発を推進いただきます。
◆業務詳細
1.GPUクラウド基盤のアーキテクチャ設計・実装
GPUノード構成、ネットワーク(IB/RoCE/Ethernet)、NVLink/NVSwitchを含むクラスタ設計。VM/Bare metal/Kubernetes など実行基盤の設計・実装。
2.オーケストレーション/スケジューリング基盤の構築
Kubernetes/Slurm/Ray などの選定・導入、GPU割当(MIG/vGPU等)、マルチテナンシー設計。
3.課金・メータリング機能の設計
GPU利用時間課金、ノード/VRAM課金モデル、顧客ポータルの仕様策定。
4.セキュリティ・コンプライアンス対応
IAM/RBAC、Zero Trust、監査ログ管理、ISMS等の認証準拠。
5.サービス全体のSLO/SLI設計と運用
障害対応、監視(Prometheus/Grafana等)、高可用性/DR設計、GPU利用効率の最適化。
運用プロセス整備(設計書・構築手順・運用手順のレビュー含む)
6.外部パートナー管理
MSP・SIer・DC事業者との技術折衝、スケジュール・品質管理、コスト管理。
7.事業推進支援
顧客向け技術資料の作成支援、PoC対応。
- 応募資格
-
- 必須
-
◆必須条件
・GPUサーバもしくはAI/HPCクラスタの構築/運用経験
・Linux(RHEL、 Ubuntuなど)の実務経験
・Kubernetesの運用経験
・ネットワーク基礎(L2/L3、VLAN、BGP/EVPNが理解できる)
・IaC(Terraform、Ansibleなど)の利用経験
・協力ベンダーや外注の技術コントロール経験
◆歓迎条件
・NVIDIA製GPU(NVLink、MIG、NCCL、DGX等)への理解
・Kubernetes+GPU Operator、Slurm、Kubeflowの運用経験
・分散学習基盤(PyTorch/DeepSpeed)の運用経験
・SRE文化(監視、可観測性、信頼性向上)の経験
・DC側の基礎知識(ラック、電源、IBネットワークなど)
【求める人物像】
・自身で手も動かせるが、ベンダー管理・調整も苦にならない方
・「80%完成でまず進める」など意思決定できる方
・新技術(GPU/HPC/AIインフラ)を早期にキャッチアップできる方
・チームで成果を出す意識があり、コミュニケーションが取れる方
- フィットする人物像
-
JAC Recruitmentでは、担当コンサルタントが直接企業へ訪問。だからお伝えできることがあります。
面談の際に、採用担当者からお聞きした情報やコンサルタント自身が感じた選考のポイントを皆さまへお届けします。
- 雇用形態
- 無期雇用
- 勤務地
- 東京都
- 勤務時間
-
【就業時間】09:00 ~ 17:00
【労働時間制等】通常の労働時間制
- 年収・給与
-
【年収】1000万円 - 1200万円
- 待遇・福利厚生
- 詳細は求人ご紹介時にご案内いたします。
- 休日休暇
- 詳細は求人ご紹介時にご案内いたします。
- キャリアパス・評価制度
- 【昇給】年1回 (4月)
