SREエンジニア【フレックス/リモート有/60事業を展開】その他インターネット関連
その他インターネット関連
【事業概要】同社は、動画配信、電子書籍、EC、ゲーム、金融など、多様な事業を展開する多角化企業です。それぞれの事業は独立したスピード感で成長する一方、その基盤となるインフラと運用の信頼性が、全社の価値提供を支えています。今回の配属先であるSRE部は、こうした同社の複数事業を横断して支える専門組織として、サービスの可用性・信頼性・パフォーマンス・コスト最適化を担っています。個別の基盤は各サービスの担当が担いますが、共通でメリットが出る部分は特定のプロダクトに閉じず、共通基盤・共通指針を整備することで、事業やチームの増減に左右されない安定した運用を実現しています。また、可観測性基盤を中心としたデータに基づく運用や、自動化・標準化による運用負荷の低減にも継続的に取り組んできました。現在はさらに一歩進み、これらの運用データや知見をAIと組み合わせることで、障害対応や意思決定をより再現性の高い形へ進化させる挑戦を進めています。SRE部のミッションは、単に「障害を防ぐ」ことではなく、事業が安心して挑戦できる土台を提供し続けることです。技術と運用の両面から同社の事業成長を支えることが、私たちの役割です。【業務内容】SRE部の一員として、同社が展開する複数の事業・サービスを横断的に支える信頼性・可用性・運用効率の向上に取り組んでいただきます。■AI Agentの開発を通した運用改善・運用データを活用した障害対応・判断支援の自動化・LLMを用いた運用ナレッジの整理・検索・活用の仕組みづくり■サービス信頼性の向上・可用性・パフォーマンス・耐障害性を考慮したシステム設計・改善・障害発生時の原因分析および恒久対応の実施■可観測性の設計・運用・メトリクス/ログ/トレースを含む可観測性全体の設計・改善・特定ツールに依存しない、可観測性の考え方・設計方針の整理・サービス特性に応じた監視・アラート設計および運用改善・運用データを活用した課題発見・障害予兆の検知・クラウド、オンプレ双方のオブザーバビリティツール基盤(Datadog/NewRelic/Prometheus)の構築・運用■運用の標準化・自動化・手作業に依存しない運用フローの設計・実装・Runbookや運用手順の整備・改善■コスト最適化の推進・クラウドリソースの利用状況の可視化・コスト削減施策の立案・実装・全社展開■事業部・開発チームとの協業・各事業のSRE/開発チームと連携した課題整理・改善提案・共通基盤・共通指針の整備による組織全体の信頼性向上【募集背景】サービス規模の拡大に伴い、同社のSRE部が向き合う運用課題は年々複雑化しています。障害対応、オンコール、コスト管理、設定変更の影響把握など、「判断が遅れること自体がリスクになる」場面も増えてきました。これまで私たちは、標準化・自動化・可観測性の整備によって運用を改善してきましたが、次のステップとして、運用データや過去の知見をAIに活用させるフェーズに進んでいます。SREの経験を持つエンジニアがAIを理解し、AIを理解したエンジニアがSREの現場を知ることでしか実現できない取り組みです。運用の最前線で課題と向き合いながら、SREのあり方そのものをアップデートしていく仲間を募集しています。【ポジションの魅力】・特定のプロダクトに閉じず、横断的な視点でSREに取り組める・可観測性・自動化・コスト最適化といったSREの王道領域をしっかり経験できる・AI活用は「必須スキル」ではなく、現場課題から自然に使うフェーズ・仕組みを作って終わりではなく、全社に広げ、定着させるところまで関われる
- 年収
- 800万円~1500万円
- 職種
- インフラエンジニア(運用設計系)
更新日 2026.08.04

