募集要項
- 仕事内容
-
【仕事内容】
AI 開発プラットフォーム事業における AI インフラエンジニアとして下記をお任せします。同社の GPU クラウドプラットフォームでは、Kubernetes を活用した大規模な AI インフラを運用、計画しています。しかし、リソース管理の最適化や可用性の向上、パフォーマンスチューニングが必要な場面が増えており、これらの課題に対応できるエンジニアを募集しています。
特に、Kubernetes を活用したクラウド環境の最適化、GPU リソースの効率的な割り当て、システムの高可用性設計 などの知見を活かし、クラウドインフラの運用をより強固なものにしていただける方を求めています。
【具体的な業務内容】
■GPU クラウドのプラットフォーム開発
■Kubernetes を活用したコンテナ環境の設計・最適化
■GPU リソース管理の最適化(スケジューリング、負荷分散)
■システムの監視・パフォーマンスチューニング
■クラウドインフラの高可用性・スケーラビリティ向上
■利用ツール:Github、Slack、Google Workspace 等
■海外エンジニアとの技術的な英語でのやり取り(翻訳ツール利用可。適切な英文を生成するためのプロンプト作成力と、翻訳結果が意図とずれていないかを判断する力が必要です)
- 応募資格
-
- 必須
-
【必須(MUST)】下記のようなご経験をお持ちの方。
■Kubernetes を使用した業務に関わったご経験
■Linux 環境でのオンプレサーバー構築・運用経験
【歓迎(WANT)】
■GPU 関連の環境構築経験(NVIDIA A100/H100 など)
■NVIDIA 系ミドルウェア(NVIDIA MIG, CUDA, TensorRT など)の活用経験
■JobScheduler(Slurm など)の運用経験
■OpenStack の構築・運用経験
■ネットワークスキル(SDN, VPC, L2/L3 ネットワークの知識)
- 雇用形態
- 正社員
- 勤務地
- 東京都
- 年収・給与
- 800~1500万円
