丸紅グループのIT基盤を構築した技術力で実現する企業セキュリティ対策。 ソリューションとサービスはこちら

異常検知とは?AI・機械学習の代表的な手法と導入事例を解説

目視検査の限界や、システム障害の対応遅れに悩んでいる企業担当者に向けて、本稿ではAIや機械学習を活用した異常検知の仕組みや代表的な手法、そして導入するメリットを解説します。読み終わると、自社の課題に適した異常検知システムの導入に向けた具体的な検討ができるようになります。異常検知は、業務効率化と品質向上を実現するうえで重要な技術といえます。

本記事に関連する資料ダウンロードはこちら >>
INDEX

異常検知とは

目視検査の精度に限界を感じていたり、システムの些細な不調を見逃してしまった経験はないでしょうか。近年、こうした現場の課題を解決する手段として、多くの企業が関心を寄せているのが「異常検知」という技術です。ここでは、次章以降を読み進めるうえで欠かせない前提知識として、この技術の輪郭を整理していきます。

異常検知の基本的な定義

異常検知とは、大量のデータの中から、通常の振る舞いとは異なる異質なデータを見つけ出す技術のことです。人間が目で見て判断するには膨大な時間がかかるデータ群から、統計学や機械学習を用いて不自然なパターンを自動的に抽出します。日々の業務において蓄積されるデータを基準とし、そこから大きく外れた値を「異常」として定義する仕組みとなります。

この技術を活用することで、人間が気づきにくい微細な変化を素早く捉えることが可能といえます。従来のルールベースでは対応しきれなかった複雑な事象に対しても、柔軟に検知できる点が大きな強みです。

異常検知が注目されている背景と課題解決

異常検知がさまざまな企業で注目されている背景には、深刻な人手不足とベテラン従業員の高齢化があります。長年にわたり職人の勘や経験に頼っていた検査業務は、人材の退職とともに技術継承が難しくなっているのが実情です。さらに、取り扱うデータの種類や量が爆発的に増加しており、人間の目視だけではすべての異常を網羅することが物理的に困難になっています。こうした課題を解決する手段として、AIや機械学習を活用した異常検知システムの導入を検討する企業が増えています。

異常検知で見つけられる3つの「異常の種類」

ひとくちに異常といっても、そのデータが示す特徴やパターンによっていくつかの分類方法が存在し、対処すべき原因もそれぞれ異なります。ここでは、実務において特に重要となる代表的な3つの異常のタイプを取り上げ、それぞれがどのような場面で発生し、どのように見分けられるのかを具体的な例とともに解説していきます。

異常の種類 概要 具体的な事象の例
点異常 単独で全体から大きく外れている値。 普段の決済額と比べて極端に高額なクレジットカード利用などがある。
文脈依存異常 特定の条件や状況下においてのみ不自然となる値。 冬季において夏向け商品のアクセスが急増するケースなどがある。
集団異常 個々の値は正常でも集まった状態が不自然なケース。 短時間に特定のサーバーへアクセスが集中する攻撃などがある。

点異常(Point Anomaly)

点異常とは、データセット全体の中で、単独で極端に外れた値を示す異常のことです。他の大多数のデータポイントとは明らかに異なる特徴を持っているため、比較的見つけやすいという特徴があります。日常的なビジネスシーンにおいては、クレジットカードの不正利用で突然数百万円の決済が行われた場合などが該当します。また、工場のセンサーで一瞬だけ異常な高温が記録されたケースも点異常と判定されるでしょう。このように、周囲のデータと比較して直感的に「おかしい」と判断できるのが点異常の基本といえます。

文脈依存異常(Contextual Anomaly)

文脈依存異常は、データ単体を見ただけでは正常に見えるものの、特定の時間や状況という文脈に照らし合わせると異常と判断されるパターンのことです。季節や曜日、あるいは特定のイベントなどの条件を考慮しないと発見できないため、高度な分析が求められます。

たとえば、深夜帯にオフィスのネットワークトラフィックが急増した場合、昼間であれば正常な量でも、時間帯の文脈を考慮するとサイバー攻撃の可能性が疑われるでしょう。データの背景にある環境を深く理解することが、この異常を検知するための鍵となります。

集団異常(Collective Anomaly)

集団異常は、個々のデータ自体は正常な範囲に収まっていても、それらが連続して発生したり集まったりすることで異常とみなされる現象のことです。単一のデータポイントだけを監視していても発見できないため、データの集合体としての振る舞いを分析する必要があります。

ITシステムの監視において、通常のアクセス範囲内であっても、同じIPアドレスから一定のリズムで絶え間なくリクエストが続く状態などは集団異常に該当します。全体のパターンや関連性を紐解くことで、目に見えない脅威を洗い出すことができると考えられます。

異常検知に用いられる代表的な機械学習手法

異常検知を実際のシステムとして構築する際には、扱うデータの特性や量に応じて、統計学や機械学習に基づくさまざまなアルゴリズムが使い分けられています。ここでは、現場で広く採用されている代表的な手法をいくつか取り上げ、それぞれの計算の仕組みや向き不向きについて詳しく紹介していきます。

代表的な手法 手法の仕組みと特徴 適しているデータの種類
ホテリング理論 正規分布を前提とし中心から離れた値を異常とみなす手法。 規則的でばらつきが少ない数値データに適している。
k近傍法 データ同士の距離を計算し周囲にデータが少ないものを探す手法。 分布が複雑で特定の法則に当てはまらないデータに適している。
LOF法 データの密集度を比較し密度が低い場所にある値を見つける手法。 クラスターの密度にばらつきがあるデータに適している。
ディープラーニング 神経網を模した構造で複雑な特徴を自動的に学習する手法。 画像や音声など人間がルール化しにくいデータに適している。

ホテリング理論

ホテリング理論は、データが正規分布(釣り鐘型の分布)に従うという前提のもとで異常を判定する、古典的で実績のある統計手法です。正常なデータの平均値からどれくらい離れているかを計算し、あらかじめ設定した基準を超えるものを異常値として扱います。計算の仕組みがシンプルであるため、システムの負荷が軽く、素早い処理が可能となります。

工場の生産ラインにおける温度や圧力の監視など、変動が一定の範囲に収まりやすいデータの分析に力を発揮するでしょう。しかし、正規分布から大きく外れる複雑なデータには適さない場合があります。

k近傍法(k-NN法)

k近傍法は、注目しているデータポイントの近くにあるデータの集まり具合を調べることで、異常かどうかを判定する手法です。周囲のデータとの距離を計算し、近くに他のデータが存在しない孤立したデータを異常とみなします。

この手法は、データが特定の確率分布に従うという前提を必要としないため、複雑な分布を持つデータにも適用しやすいといえます。購買データの分析や、ユーザーの行動パターンの分類などで幅広く活用されています。ただし、計算量が多いため、膨大なデータをリアルタイムで処理する際には工夫が必要と考えられます。

LOF(Local Outlier Factor)法

LOF法は、データが存在する空間の「密度」に注目して異常を見つけ出す手法です。単に距離を測るだけでなく、周囲のデータがどれくらい密集しているかという局所的な密度を計算し、他の領域と比較します。密集しているグループから少し離れた場所にあるデータを、効果的に外れ値として検出することが可能です。k近傍法では見落としてしまうような、密度の異なる複数のグループが混在するデータセットにおいて、高い精度を発揮します。クレジットカードの利用履歴など、多様なパターンが混ざり合うデータの分析に役立つでしょう。

ディープラーニング(深層学習)によるアプローチ

ディープラーニングは、人間の脳の神経回路を模したニューラルネットワークを用い、データに潜む複雑な特徴をコンピュータ自身が抽出する手法です。従来の機械学習では、人間が「どこに注目すべきか(特徴量)」を手作業で設定する必要がありましたが、ディープラーニングはその工程を自動化できます。画像や音声、自然言語といった、ルールベースで定義することが難しい非構造化データの分析において、高いパフォーマンスを示すことが知られています。特に製造業の外観検査では、微細なキズや汚れを高精度で判別する主力技術として定着しています。

機械学習モデルの学習アプローチの違い

異常検知のためのAIモデルを構築する際には、学習に使用するデータの準備方法によって、大きく二つの方向性に分かれます。ここでは、それぞれのアプローチがどのような仕組みで異常を判定しているのか、また自社のデータ状況に応じてどちらを選ぶべきなのかを整理して解説します。

学習のアプローチ 必要なデータの状態 この手法を選ぶメリット
教師あり学習 正常と異常のラベルが付与された大量のデータが必要。 判定の精度が高く特定の異常を確実に見つけ出せる点。
教師なし学習 正常なデータのみを用意すれば学習を開始できる状態。 未知の異常にも対応しやすく事前のデータ準備が楽になる点。

教師あり学習による異常検知

教師あり学習は、人間が「これは正常」「これは異常」という正解ラベルをあらかじめデータに付与し、そのパターンをAIに学習させるアプローチです。AIは提供された正解データを基に特徴を記憶するため、学習済みの特定の異常に対しては極めて高い精度で検知できるようになります。すでに発生したことのある不良品や、過去に確認されたサイバー攻撃の手口を見つけ出す目的に最適といえます。

一方で、未知の異常には対応しづらく、正解ラベルを作成するための膨大な作業コストがかかることが課題となるでしょう。

教師なし学習による異常検知

教師なし学習は、異常のラベル付けを行わず、正常なデータのみを大量に読み込ませて「当たり前の状態」をAIに理解させるアプローチです。AIは正常パターンのモデルを構築し、そこから逸脱するものをすべて異常として報告します。

この方法の最大の利点は、過去に発生したことのない未知のトラブルや、想定外の欠陥も検知できる可能性があることです。また、異常データを用意する手間が省けるため、導入のハードルが比較的低くなります。ただし、人間が意図しない些細な変化まで異常として検出してしまう過検出のリスクに注意が必要と考えられます。

異常検知システムを導入する主なメリット

異常検知システムを実際の業務に取り入れることで、企業はコスト削減や品質向上、人材不足の解消など、さまざまな恩恵を得ることが期待できます。ここでは、システムを導入することによって現場で具体的にどのような課題が解決され、どのような効果がもたらされるのかを、複数の観点から詳しく解説していきます。

導入によるメリット 現場で解決される課題 期待できる具体的な効果
検知精度の向上 人間の疲労による見落としや基準のばらつきを防ぐ。 不良品の流出率が低下し顧客からの信頼が高まる効果。
ダウンタイムの回避 突然の設備故障による生産ラインの長期停止を防ぐ。 修理コストの削減と安定した生産計画の維持ができる効果。
業務効率化の実現 ベテラン作業員への業務集中や技術継承の難しさを解消する。 人員を別の高度な業務へ配置転換し生産性が向上する効果。

人的ミスの削減と検知精度の向上

人間による長時間の目視検査やデータ監視は、疲労や集中力の低下によるヒューマンエラーが生じやすい傾向があります。異常検知システムを導入することで、24時間365日、一定の品質で疲れを知らずに監視を続けることが可能となります。システムは感情や体調に左右されないため、判定基準が均一化され、誰が担当しても同じ結果が得られるようになります。微細な変化を正確に捉えるAIの力を借りることで、不良品の流出やインシデントの見逃しを大幅に減らすことが期待できるでしょう。品質管理のレベルを一段階引き上げるための強力な武器といえます。

予知保全によるダウンタイムの回避

工場の設備やITシステムにおいて、完全に故障してから対応する事後保全では、復旧までに多大な時間とコストがかかります。異常検知を活用した予知保全では、機械の振動や温度、サーバーの稼働ログなどの微細な変化から、故障の兆候をいち早く捉えることができます。異常が深刻化する前に部品の交換やメンテナンスを実施できるため、想定外のシステム停止(ダウンタイム)を未然に防ぐことが可能と考えられます。結果として、事業継続計画の強化につながり、安定したサービス提供や生産活動を支える基盤になると考えられます。

属人化の解消と業務効率化

熟練の担当者が持つ暗黙知や経験則に依存している業務は、その人物が不在になった途端に業務が滞るリスクを抱えています。異常検知システムによって基準をデジタル化し自動化することで、属人化の解消につなげることができます。これまでベテランの目に頼っていた検査をシステムに任せれば、経験の浅い担当者でも同等レベルの業務を遂行できるようになるでしょう。浮いた人材リソースを、製品開発や顧客対応などのより創造的で付加価値の高い業務に振り分けることで、企業全体の生産性向上が期待できます。

【事例】異常検知の業界別活用事例

異常検知の技術は、すでにさまざまな業界の現場で実用化が進んでいます。ここでは、AIによる画像解析で品質管理を高度化した食品業界の事例と、IoTセンサーを活用して設備の予知保全を実現している製造業の取り組みを紹介します。自社の課題と照らし合わせながら、導入イメージの参考にしてみてください。

AIの画像解析による原料検査の自動化

キユーピーは、ディープラーニングによる画像解析を用いた原料検査装置を自社開発し、グループ会社であるデリア食品の惣菜工場にて、いちょう切りニンジンなどカット野菜の検査工程へ2019年1月から導入しました。この装置の特徴は、不良品ではなく良品のパターンをAIに学習させるという逆転の発想です。良品以外をすべて不良として検出できるため、変色や変形など不良パターンが多岐にわたる原料検査でも高い精度を実現しています。従来の目視検査は作業者の身体的負担が大きいことが課題でしたが、自動化によって負担を軽減しつつ、品質向上にもつなげた事例といえるでしょう。

AIを活用した原料検査装置をグループに展開 | ニュースリリース | キユーピー

IoTセンサーを活用した設備の予知保全

製造業の設備保全の分野でも、IoTセンサーを組み合わせた異常検知の導入が加速しています。生産ラインの回転機器やポンプなどに振動センサーや温度センサーを設置し、収集したデータをクラウド上のダッシュボードでリアルタイムに可視化することで、設備の異常兆候を早期に捉える取り組みが代表的です。あらかじめ設定した閾値を超えた場合にアラートを自動で発報する仕組みを併用すれば、人間が24時間体制で計器を注視し続ける必要がなくなります。近年では、センサーデータの収集からAI分析までを一気通貫で行えるクラウドサービスも登場しており、大規模な機械学習モデルを自社で構築しなくても予知保全を始められる環境が整いつつあります。

異常検知システム導入を成功させるためのポイント

異常検知システムは導入するだけで自動的に成果が出るわけではなく、事前の準備や進め方によって得られる効果が大きく変わってきます。ここでは、プロジェクトを確実に成果へ結びつけるために押さえておくべき準備と進め方を解説します。

導入のステップ 実施すべき具体的な内容 進行時の注意点
目的の明確化 何の課題を解決しどの業務を効率化するのかを定義する手順。 現場の意見を取り入れずに開発を進めると使われないシステムになるリスクがある。
データ収集 AIに学習させるための良質な正常データと異常データを集める手順。 データの形式がバラバラだと前処理に膨大な時間がかかるリスクがある。
PoCの実施 小規模な環境で技術的に実現可能かどうかを検証する手順。 最初から完璧な精度を求めると開発期間が長引き失敗しやすいリスクがある。

目的の明確化と適切なデータ収集

異常検知プロジェクトを立ち上げる際、最初にすべきことは「何を解決したいのか」を明確に定義することです。不良品の流出を防ぎたいのか、機器の故障を予測したいのかによって、選ぶべき手法や必要なシステム構成が大きく変わります。

目的が定まった後は、分析の基盤となるデータの収集に取り掛かります。AIの性能は与えられるデータの質に強く依存するため、ノイズが少なく整理されたデータを継続的に蓄積できる環境を整えることが重要といえます。現場の担当者と綿密に連携し、本当に必要なデータを見極めるとともに、データの形式を早い段階で統一しておくことが重要です。形式がバラバラなまま収集を進めると、前処理に膨大な時間を費やすことになりかねません。

スモールスタートによるPoC(概念実証)の実施

システムを本格的に導入する前に、特定のラインや一部の業務に限定して小さく検証を始めることが推奨されます。この検証プロセスはPoC(概念実証)と呼ばれ、選定したAIモデルが実際の現場環境で想定通りの精度を出せるかを確認するために行います。

初期段階から全社的な導入を目指すと、想定外のトラブルや莫大なコストに見舞われる可能性が高いでしょう。まずは小さな成功体験を積み重ね、費用対効果が確認できた段階で適用範囲を広げていくアプローチが、プロジェクトを安全に成功へと導くと考えられます。

まとめ

この記事の要点をまとめます。

  • 異常検知はデータから通常と異なる振る舞いを抽出する技術である
  • 機械学習の手法にはホテリング理論やディープラーニングなどが存在する
  • 導入することで人的ミスの削減や予知保全による業務効率化が実現する

自社の課題に合わせて適切な手法を選択し、小規模な検証からシステム導入を検討してみてください。

本記事で紹介したとおり、センサーデータの監視による予知保全は、異常検知の代表的な活用領域のひとつです。自社設備や工場にIoTセンサーを導入し、異常検知をはじめとしたデータ活用を進めたいとお考えの方に向けて、センサーデータの収集から可視化、アラート通知、AI分析までをワンストップで提供するクラウドサービスをご紹介します。

本サービスは、オンプレミスにも対応可能なIoTプラットフォーム「SyncWave Cloud Service Platform」上で、ダッシュボードによる可視化、AIを用いた分析、閾値にもとづくアラート通知までを一貫して実現できます。ノーコードで誰でも簡単にダッシュボードを構築できるため、初めての産業IoT導入でも取り組みやすい点が特長です。

SyncWave Cloud お役立ち資料

SyncWave Cloudの紹介資料をダウンロードいただけます。