Operations & TroubleshootingReviewed 2026-09-10

Networking KQL Patterns

AzureDiagnostics/Resource-specific tablesやflow dataをKQLで絞り込み、incident timelineを再構成する。

Scope: 設計・運用で誤りやすい点を優先して整理。SKU/region/limitsは変更されるため、実装時はリンク先のcurrent Microsoft Learnを再確認してください。

Overview

AzureDiagnostics/Resource-specific tablesやflow dataをKQLで絞り込み、incident timelineを再構成する。

Key technical points

  • TimeGeneratedを必ず狭め、ResourceId/Category/OperationNameを早い段階でfilterする。
  • IP/port/action/FQDN/rule nameをprojectしてchange recordと突き合わせる。
  • schemaはdiagnostic setting modeやresourceによって異なるためworkspaceで実columnを確認する。

Design guidance

  • 最初にtime window、subscription、resource ID、5-tuple、source/destinationを固定する。
  • Portal表示だけでなくCLI/API、Network Watcher、diagnostic logsで再現可能なevidenceを取る。
  • 変更前後のdiffとobservable flowを保存し、復旧後もroot causeを確定する。

Operations checklist

  1. UTC/JST両方でincident time windowを固定する。
  2. read-only snapshotをJSON/CSVで保存する。
  3. change完了後に同じtest vectorを再実行して証跡を残す。

Common pitfalls

  • Portal screenshotだけで再現条件を残さない。
  • ログを見始める前にtime range/resource IDを固定しない。

Verification pattern

Control plane
resource state、association、policy、route/BGP configが期待通りかを確認。
Data plane
同一5-tupleまたは実application journeyで到達性・latency・security判定を実証。
Observability
diagnostic logs / flow logs / Network Watcherで実際の判定とpathを残す。
Rollback
設定を戻した後のroute convergence、DNS cache、existing sessionまで確認。

Official sources