発生日:2025年11月18日。

Cloudflareは、断続的な障害と遅延の増大を引き起こした内部サービスの機能低下後、世界規模のネットワーク全体で通常運用を復旧した。同社のステータス記録では最終的に事案が解決済みとされた一方、エンジニアはプラットフォームの監視と先の障害の調査を続けた。

この事案は、顧客向けの単一製品ではなく、Cloudflareのサービスポートフォリオの複数部分に影響した。対応中、同社はアプリケーションサービスへの広範な影響と、一部顧客がCloudflareのダッシュボードへのログインや利用を試みた際の問題を報告した。Cloudflare AccessとWARPについても復旧作業が必要だった。

ある段階では、対応担当者が修復作業の一環としてロンドンでWARPへのアクセスを無効にした。同地でインターネット接続にWARPを利用していたユーザーは、サービス経由で接続できなくなった。その後Cloudflareは、変更によってAccessとWARPのエラー率が以前の基準値に戻り、ロンドンのアクセスポイントを再び有効にできたと発表した。

ダッシュボードは別途導入された変更によって復旧したが、アプリケーションサービスにはさらなる対応が必要だった。その後の更新では、全域が即座に通常へ戻ったのではなく、段階的に改善していると説明された。各チームが地域全体に残る問題を解消し、修正の導入後に残った問題に対処する間も、顧客には時折エラーが発生した。

Cloudflareはまた、世界規模の復旧中、ボットスコアが断続的に信頼できなくなる可能性があると警告した。同社は提供されたインシデント記録の中で技術的原因を示していない。メッセージは、サービスの復旧、エラーと遅延の継続的な観測、導入後に残った影響の軽減に重点を置いていた。

復旧が進むにつれてエラー水準は低下し、遅延は通常に近づいた。Cloudflareは、問題の再発を確認しながら、復旧を加速する方法を検討していると説明した。修正を導入した後も、同社は事案の解決を宣言する前にネットワークの監視を続けた。

Cloudflareは最後の更新で、サービスは通常どおり稼働しており、増加していたエラーや遅延はもはや確認されないと発表した。その時点では設定変更を行っていないと述べ、事案中に一時的に無効化したサービスは安全に再び有効にできると顧客に案内した。エンジニアは引き続き詳細な検証に取り組んだ。

調査後の最終報告は、調査完了後に公表するとされた。その分析が得られるまで、ステータス記録から分かるのは運用上の経緯と影響を受けた製品であり、発端となった障害ではない。この区別は重要だ。復旧は症状が収まったことを確認するものだが、機能低下が複数のサービスに広がった理由と、再発防止にどのような措置を講じられるかを説明するには、完了した技術的検証が必要となる。

一時的に無効化した機能を再び有効にするよう案内したことは、復旧に対する運用上の自信を示したが、Cloudflareは復旧を作業の終わりとはみなさなかった。継続的な監視と予告された検証により、顧客への差し迫った影響に対処した後も、安定性を確認し、障害を記録する余地が残された。