build_circleTool Update
Google Cloud、障害を意図的に発生させるFault Injection Testingをプレビュー
Google Cloudが障害注入テスト機能をプレビュー。Cloud SQLの切り替えや通信遅延を安全に再現し、実行前のドライランと緊急停止を備え、本番適用前の耐障害性確認に使う。
概要
※本記事は公開情報をもとに編集部が再構成したサマリです。一次情報は出典欄をご参照ください。
Google Cloudは2026年8月26日、クラウド環境へ意図的に障害を発生させ、復旧設計を確認する「Fault Injection Testing」をプレビュー公開した。Cloud SQLのフェイルオーバーや、ロードバランサーを通る通信への遅延・エラー追加を自動化し、実障害の前に耐障害性を検証する。
事実のポイント
- 実験テンプレートで障害の種類、対象資源、継続時間を定義する
- Cloud SQLの高可用構成に対する切り替えと、通信の遅延・HTTPエラーを試験できる
- 実行前に読み取り専用のドライランを行い、対象資源と権限を確認する
- 実験中は停止と復旧を指示でき、設定時間の終了後には障害を戻す
用語・背景の補足
障害注入テストは、意図的な失敗を起こして監視、切り替え、通知、復旧手順が設計どおり動くか確認する方法である。構成図や手順書だけでは、権限不足、想定外の依存関係、通知の遅れなど実行時の問題を発見しにくい。AIエージェントを含む長時間処理では、途中停止からの再開や二重実行の防止も重要な検証対象になる。
プレビュー段階では非本番環境で試すことが推奨されている。対象を明示し、ドライランの結果を承認してから実行し、停止責任者を置くことが基本となる。テスト成功はすべての障害への耐性を保証しないため、データベース、ネットワーク、外部APIなど失敗の種類を分け、定期的に再検証する必要がある。
注意点
- プレビュー機能であり、まず非本番環境での検証が推奨される
- ドライランで対象を確認しても、処理中の業務影響まで完全には予測できない
- 実験の権限、停止手順、実施時間帯を事前に定める必要がある
編集部見解
(追記予定)
info 公開情報をもとに編集部が再構成したサマリです。一次情報・追加情報は出典欄をご参照ください。