結論
SRE転職では、信頼性を測り、開発速度とのバランスを取った経験が重要です。
この記事はこんな人向け
- SREを目指す人
- 運用改善をキャリアにしたい人
SREの仕事を理解する
監視だけでなく、SLI/SLO、キャパシティ、障害対応、自動化、開発支援などを担います。
- 信頼性指標
- インシデント対応
- トイル削減
組織を見極める質問
SLOの運用、オンコール体制、開発チームとの責任分担、振り返り文化を確認します。
SRE経験をどう棚卸しする?
信頼性の判断と実装をセットにする
監視を作った経験だけでなく、どの利用者の行動を守るために何を測り、問題が起きたときにどう動くのかを整理します。自動化についても、手作業が発生する原因と削減した範囲を説明します。
GoogleのSRE書籍にはSLO、監視、オンコール、トイルなどの論点が整理されています。ただし企業ごとに役割は違うため、書籍の用語が求人にあるだけで同じ業務だと判断しないようにしましょう。
オンコールの体制を確認する
当番の人数、交代頻度、呼び出し時の連絡方法、翌日の扱い、対応できないときの支援を確認します。個人に依存せずチームで対応できる仕組みがあるかが重要です。
障害後に個人の責任追及だけで終わらず、設計や運用を改善する場があるかを質問します。日常の作業と信頼性改善の比率を聞き、自分が伸ばしたい経験を積める環境か比較してください。
- 障害対応後の振り返りと改善
- アラートの見直しを行う責任者
- 開発側と共有する品質の目標
転職準備の実践ステップ
システムの状態を測った経験を、利用者にとって重要な動作と結びつけて整理します。監視対象が多いことより、どの変化を異常として扱い、誰がどう対応するかを説明できることが大切です。誤検知や対応不要な通知を減らした経験があれば、その判断過程も記載しましょう。
選考では、信頼性改善と新機能開発の優先順位が衝突したときに、どう合意を作るかを質問します。SREがすべての運用責任を持つのか、開発チームと責任を共有するのかも確認してください。オンコールの負担だけではなく、問題の再発を防ぐ実装や開発支援に関われる時間があるかを比較します。
おすすめ転職サービス
相談先は得意領域と対象経験を確認し、複数の提案を比較して選びましょう。
よくある質問
インフラ経験だけでSREになれますか?
強い土台になります。ソフトウェア開発、自動化、信頼性を指標で扱う経験を補いましょう。
まとめ
SRE転職では、信頼性を測り、開発速度とのバランスを取った経験が重要です。
サービス内容や応募条件は変わる可能性があります。最終的な判断の前に、各社の公式サイトと面談で最新情報をご確認ください。
あわせて読みたい記事
参考資料
以下は技術・職務理解の参考資料です。転職サービスの推奨順位や採用結果の根拠を示すものではありません。