時系列データの異常検知:しきい値監視とAI検知の使い分け
設備のセンサーデータを監視しているが、しきい値のアラートでは故障の予兆を捉えきれない。かといってAIによる異常検知を入れるべきか判断がつかない。本記事では、そんな設備保全・品質管理の現場担当者に向けて、しきい値監視とAI検知それぞれの得意・不得意と、ケース別の使い分けの判断基準を実務目線で整理します。
比較の前提:時系列データの異常検知で何を判断するのか
ここで扱うのは、設備に取り付けた振動・温度・電流・圧力などのセンサーから得られる時系列データを使って、「設備の異常や故障の予兆をいつ、どうやって検知するか」という選択です。選択肢は大きく2つあります。
- しきい値監視:「振動が4.5mm/sを超えたら警報」のように、固定の上限・下限で判定する方式
- AIによる異常検知:正常時のデータの振る舞いを学習し、「いつもと違うパターン」を統計的・機械学習的に検出する方式
重要なのは、この2つは「新旧」や「優劣」の関係ではなく、検知したい異常のタイプが違うということです。片方をもう片方で置き換えるのではなく、対象設備と異常モードに応じて組み合わせるのが実務上の正解になるケースがほとんどです。
しきい値監視の強みと限界
強み:説明しやすく、運用コストが低い
しきい値監視の最大の強みは、判定根拠が誰にでも説明できることです。「規定値の4.5mm/sを超えたから停止した」という説明は、現場のオペレーターにも品質保証部門にも監査にも通ります。ISO 10816のような振動評価基準や、メーカーが指定する管理値がある場合、しきい値監視はそのまま規格準拠の運用になります。 また、実装・運用コストが圧倒的に低いのも利点です。PLCやSCADAの標準機能で設定でき、学習データの収集も再学習も不要です。故障モードが明確で、異常時に値が急変するタイプの異常(軸受の焼き付き直前の温度急上昇、配管詰まりによる圧力急上昇など)には、しきい値監視で十分に対応できます。
限界:緩やかな劣化と「正常範囲内の異常」を見逃す
一方で、しきい値監視には構造的な弱点があります。典型的なのが緩やかな劣化の見逃しです。例えばあるポンプの振動値が、通常2.0mm/s前後で安定していたところ、3か月かけて4.3mm/sまでじわじわ上昇したとします。管理しきい値が4.5mm/sなら、この間アラートは一度も鳴りません。しかし正常時の2倍以上の振動は、明らかに何かが起きているサインです。
もう一つの弱点は、運転条件によって「正常な値」が変わる設備への対応です。回転数や負荷が変わる設備では、高負荷時の正常値が低負荷時の異常値より高いことが普通にあります。安全側にしきい値を下げれば誤報が増え、誤報が続くと現場はアラートを無視するようになります。「アラートが多すぎて誰も見ていない」状態は、監視していないのと同じです。
AIによる異常検知の強みと注意点
強み:「いつもと違う」を多変量・文脈込みで捉える
AIによる時系列の異常検知は、正常時のデータからパターンを学習し、そこからの逸脱度をスコアとして出力します。手法は統計的なもの(ホテリングT2、変化点検知)から機械学習(Isolation Forest、オートエンコーダ、LSTMベースの予測モデル)まで幅がありますが、実務上の価値は共通しています。
- 緩やかな劣化トレンドの早期検知:しきい値到達の数週間〜数か月前に予兆を捉えられる
- 多変量の相関異常の検知:温度・電流・振動の個々は正常範囲でも、「電流が上がっているのに流量が上がらない」といった関係性の崩れを検知できる
- 運転条件への追従:負荷や回転数を入力に含めれば、条件ごとの正常範囲を自動的に区別できる
特に多変量の相関異常は、人手のしきい値設計では事実上カバーできない領域で、AI検知の独壇場です。
注意点:データの質と「異常スコアの運用設計」が成否を分ける
ただしAI検知には前提条件があります。まず正常データが十分にあること。目安として、対象設備の運転パターン(季節変動、品種切り替え、負荷変動)を一通り含む期間のデータが必要です。月次で運転条件が変わる設備なら最低でも数か月分、季節影響が大きいなら1年分が欲しいところです。データ欠損やセンサー故障による異常値が混ざったまま学習すると、検知性能は大きく落ちます。 もう一つ見落とされがちなのが、異常スコアをどう運用に落とすかです。AIが出すのは「異常度0.87」のようなスコアであり、結局はスコアに対するしきい値と、アラート時のアクション(点検指示を出すのか、記録だけか)を決める必要があります。ここを曖昧にしたまま導入すると、「スコアは出ているが誰も見ていない」という、しきい値監視の誤報疲れと同じ末路をたどります。 また、設備改造や部品交換のたびに「正常」の定義が変わるため、再学習の運用ルール(誰が、どのタイミングで、どのデータで学習し直すか)を導入時に決めておくことが不可欠です。
ケース別の使い分け:判断基準の整理
実務での判断基準を表に整理します。ポイントは「異常のタイプ」「運転条件の変動」「見逃しコスト」の3つです。
| 状況 | 推奨 | 理由 |
|---|---|---|
| 異常時に値が急変する故障モード(焼き付き、詰まり等) | しきい値監視 | 急変は固定しきい値で確実に捕捉でき、判定根拠も明確 |
| 規格・監査で管理値の遵守を示す必要がある | しきい値監視(必須) | AIスコアは規格準拠の根拠にならない。しきい値は残す |
| 数週間〜数か月かけて進む劣化(軸受摩耗、フィルタ目詰まり等) | AI検知(トレンド・変化点検知) | しきい値到達前の予兆段階で計画保全に回せる |
| 負荷・回転数・品種で正常値が大きく変わる設備 | AI検知(多変量モデル) | 条件別しきい値の人手管理は破綻しやすい |
| 突発停止1回の損失が大きい重要設備 | 両方の併用 | しきい値で最終防衛線、AIで早期予兆を担う二段構え |
| 正常データが数週間分しかない・故障モードが未整理 | まずしきい値監視+データ蓄積 | データ不足のAI導入は誤報の温床。蓄積後に段階移行 |
実際の現場では、重要設備20〜30台のうち、AI検知が本当に効くのは「劣化がゆっくり進み、かつ停止損失が大きい」数台に絞られることが多いです。全設備に一律でAIを入れるのではなく、しきい値監視をベースにしつつ、効果の大きい設備からAI検知を重ねるのが費用対効果の高い進め方です。
失敗しない進め方:しきい値からAIへの段階移行
しきい値監視からAI検知へ移行する際は、次の手順をおすすめします。
- 現状のアラート実績を棚卸しする:過去1年のアラート件数、そのうち実際に対応が必要だった件数(真陽性率)、見逃した故障の件数を集計する。誤報率が高い、または見逃しがある設備がAI検知の候補になる。
- 対象設備を1〜2台に絞る:劣化性の故障履歴があり、センサーデータが1年程度蓄積されている設備が理想。
- 過去データで後ろ向き検証をする:過去の故障事例に対して、AIモデルが何日前に予兆を検知できたかを検証する。ここで「しきい値より平均で3週間早く検知できた」といった定量的な効果が示せなければ、本導入は見送る判断も必要。
- 並行運用期間を設ける:既存のしきい値監視は止めず、AI検知のアラートを2〜3か月併走させて誤報率と現場の運用負荷を確認する。
- アクションと再学習ルールを文書化してから本運用へ:スコア超過時の対応フローと、部品交換・設備改造後の再学習手順を決めてから切り替える。
特に手順3の後ろ向き検証は重要です。数週間の小規模なPoCで「このデータで、この異常が、どれだけ早く検知できるか」を確かめてから投資判断をすることで、導入後に「思ったより効かなかった」という失敗を避けられます。
選択の決め手:異常の進み方と、アラート後のアクション
最後に、迷ったときの決め手を2つに絞ります。1つ目は異常の進み方です。急変する異常ならしきい値監視で十分、緩やかに進む劣化や多変量の相関崩れを捉えたいならAI検知が必要です。過去の故障記録を振り返り、「そのとき値はどう動いていたか」を確認するだけで、多くの場合どちらが必要かは判断できます。 2つ目はアラートが鳴った後に何をするかです。予兆を検知しても、点検や部品手配のアクションにつながらなければ意味がありません。逆に、3週間前に予兆が分かれば計画停止に組み込める設備なら、AI検知の投資対効果は明確に計算できます。検知方式の選択は技術の問題である以上に、保全計画とアラート運用の設計の問題です。まずは1台の設備で、過去データを使った小さな検証から始めてみてください。
