画像処理におけるしきい値処理とは何ですか?
このガイドで画像処理におけるしきい値処理を解説します。しきい値処理とは何か、Otsuのしきい値処理を含むさまざまな画像しきい値処理技術を学びます。

この記事で扱う概念を視覚的に理解するには、以下の動画をご覧ください。
私たち人間は画像を一貫性のある意味のある写真として捉えますが、コンピューターは画像を構成する最小単位である小さなピクセルの格子として捉えます。画像処理と呼ばれるプロセスでは、画像を改善したり有用な情報を抽出したりするために、これらのピクセルを調整または分析できます。
一般的な画像処理技術の一つに、画像のしきい値処理があります。この手法では、各ピクセルを設定した値と比較することで、グレースケール画像(各ピクセルが灰色の濃淡を表す画像)を白黒画像に変換します。これにより、重要な領域と背景を明確に分離できます。
しきい値処理は、画像を分析しやすくするために意味のある領域へ分割する技術である画像セグメンテーションでよく使用されます。通常、機械が視覚データを解釈する際の最初の手順の一つです。この記事では、しきい値処理とは何か、どのように機能するのか、実際の用途でどのように適用されるのかを見ていきます。早速始めましょう。
画像のしきい値処理に関する基本用語#
しきい値処理の仕組みを詳しく見る前に、その基本的な考え方と画像処理での使われ方を確認しましょう。
二値画像のしきい値処理#
画像内の物体を背景から分離したい場合を考えてみましょう。その方法の一つがしきい値処理です。画像を簡略化し、すべてのピクセルを完全な黒または完全な白にします。その結果、各ピクセルが0(黒)または255(白)の値を持つ二値画像が得られます。この手順は、画像の重要な部分を明確に目立たせるため、画像処理で役立つことがよくあります。

図1. しきい値処理後のグレースケール画像と二値出力。(出典:blog.devops.dev)
ヒストグラム#
同様に、画像全体における明るさの値の分布を把握したい場合は、ヒストグラムが役立ちます。これは、黒(0)から白(255)までの各ピクセル強度がどの程度の頻度で現れるかを示すグラフです。
ヒストグラムを見ると、画像が暗いのか明るいのか、あるいはその中間なのかを確認できます。パターンやコントラストのレベルを一目で把握できるため、画像を白黒に変換する際に適切なしきい値を選びやすくなります。
前景と背景#
画像にしきい値処理を適用すると、前景と背景の2つの部分に分けられます。通常は白で表示される前景には、テキスト、形状、検出したい物体などの重要な要素が強調されます。黒で表示される背景は、それ以外のすべてです。この分離により、機械は画像内の重要な対象に集中できます。
セグメンテーション#
前述のとおり、セグメンテーションは明るさやテクスチャなどの特徴に基づいて、画像を意味のある領域に分割します。しきい値処理はそのための単純な方法であり、コンピュータービジョンパイプラインの最初の手順の一つとしてよく使われます。
コンピュータービジョンは、人間と同じように機械が視覚データを処理・解釈できるようにするAIの分野です。処理の早い段階でしきい値処理を使用すると、コンピュータービジョンシステムは物体を背景から分離できるため、検出や認識など後続の処理を正確に実行しやすくなります。
グローバルしきい値処理#
しきい値処理について理解が深まったところで、画像にしきい値処理を適用する方法と、画像処理におけるさまざまなしきい値処理の種類を見ていきましょう。
例えば、グローバルしきい値処理は二値画像を作成する最も簡単な方法の一つです。画像全体に単一の強度値を適用します。このしきい値より明るいピクセルは白に、暗いピクセルは黒になります。これにより、物体を背景から分離できます。
均一な照明でコントラストが強い画像に最適です。ただし、照明が不均一な場合やコントラストの低い領域では、単一のしきい値によって細部が失われたり、エッジがぼやけたりすることがあります。
この問題に対処するため、Otsuのしきい値処理などの手法が使われます。値を手動で設定する代わりに、Otsuのしきい値処理では画像のヒストグラムを分析し、ピクセル強度を前景と背景に最も適切に分離できるしきい値を選択します。

図2. Otsuのしきい値処理を適用する前後の土星の画像。(出典)
ローカル(適応型)しきい値処理#
グローバルしきい値処理とは異なり、適応型またはローカルしきい値処理では、画像の異なる部分ごとにしきい値を個別に計算します。そのため、影のあるスキャン文書やテクスチャ表面など、照明が不均一な画像により効果的です。
画像を小さな領域に分割し、各ブロックのローカルしきい値を計算することで、前景と背景のコントラストを維持します。このアプローチは、画像全体で照明が変化するテキスト認識、医用画像処理、表面検査などのタスクで広く使用されています。
画像処理における適応型しきい値処理の一般的な手法には、適応型平均しきい値処理と適応型ガウシアンしきい値処理があります。適応型平均しきい値処理では、局所近傍のピクセル強度の平均を中央ピクセルのしきい値として使用します。一方、適応型ガウシアンしきい値処理では、ガウシアンウィンドウによる加重平均を使用し、中央に近いピクセルをより重視します。
画像処理におけるしきい値処理の実世界での用途#
次に、画像のしきい値処理が実世界のどのような用途で使われているかを見ていきましょう。
文書の二値化とOCRのための画像のしきい値処理#
古い書籍や手書きの手紙は、保存したり、印刷または手書きの文字を読み取る技術であるOCR(光学文字認識)を使ってデジタルテキストに変換したりするために、スキャンされることがよくあります。テキストを抽出する前に、通常は文書のクリーニングや前処理が必要です。スキャン画像には影、薄くなったインク、照明のむらなどがあることが多く、文字認識が難しくなる場合があります。
明瞭度を高めるため、しきい値処理を使用してグレースケール画像を二値形式に変換し、テキストを背景から分離しやすくします。文字などの暗い領域は黒になり、明るい背景は白になるため、OCRシステムがテキストを読み取りやすくなります。

図3. 歴史的文書とそのしきい値処理画像の例。(出典)
医用画像処理でのしきい値処理の使用#
同様に、医用画像処理では、X線画像の骨や肺など、スキャン画像内の特定の構造を分離するために、しきい値処理がよく使用されます。グレースケール画像を二値形式に変換すると、関心領域を周囲の組織から分離し、さらなる分析に向けて画像を準備しやすくなります。より複雑なケースでは、多レベルしきい値処理を適用して画像を複数の異なる領域に分割し、異なる種類の組織や構造を同時に識別できます。

図4. 胸部X線画像への多レベルしきい値処理手法の適用。(出典:sciencedirect.com)
画像処理におけるしきい値処理のメリットとデメリット#
画像処理でしきい値処理を使用する主なメリットをいくつか紹介します。
- リソース消費が少ない: しきい値処理は低消費電力デバイスで適切に動作し、クラウドアクセスや高性能なハードウェアを必要としないため、組み込みシステムやオフライン環境に適しています。
- 解釈しやすい: 単純なロジックにより、しきい値処理の出力は理解やデバッグが容易です。透明性が重視されるヘルスケアや文書処理などの分野では、これは重要な利点です。
- 迅速なテスト: しきい値処理を使うと、より複雑なモデルに移行する前に、初期段階のプロジェクトでセグメンテーションのアイデアを迅速に検討できます。
画像のしきい値処理は多くの場面で役立ちますが、いくつかの制約もあります。考慮すべきしきい値処理に関する課題を紹介します。
- 適応性に欠ける: しきい値処理は固定されたルールに従うため、手動で調整しない限り、新しい照明条件やデータの変動に対応できません。
- ノイズに敏感: 影や反射による明るさのわずかな変化によって結果が乱れることがあります。特に、細部やテクスチャを含む画像を扱う場合に顕著です。
- 静的でルールベース: AIモデルとは異なり、しきい値処理はデータから学習したり、時間の経過とともに改善したりしません。設計された限定的な条件の範囲内でのみ機能します。
画像のしきい値処理を超えて:コンピュータービジョンが適切なツールとなる場面#
しきい値処理は、管理された環境での単純なセグメンテーションタスクには適しています。しかし、複数の物体や背景ノイズを含む複雑な画像を扱う場合は、苦戦することがよくあります。固定されたルールに依存するため、しきい値処理には多くの実世界の用途で必要となる柔軟性がありません。
こうした限界を超えるため、現在では多くの最先端システムがコンピュータービジョンを使用しています。しきい値処理とは対照的に、ビジョンAIモデルは複雑なパターンや特徴を検出するように学習されるため、はるかに高精度で適応性に優れています。
例えば、Ultralytics YOLO11などのコンピュータービジョンモデルは、物体の検出や画像のセグメンテーションをリアルタイムで実行できます。そのため、自動運転車で交通信号を検出したり、農業で作物の問題を特定したりするタスクに適しています。
特に、Ultralytics YOLO11は、コンピュータービジョンタスクに対応しており、画像内の各物体を個別にセグメンテーションするインスタンスセグメンテーションなどを実行できます。また、ポーズ推定(物体の位置や姿勢の判定)や物体追跡(動画フレーム間で移動する物体の追跡)など、その他のビジョンベースのタスクも実行できます。

図5. YOLO11により、物体の検出とセグメンテーションを簡単に実行できます。(出典)
しきい値処理は単純なタスクや初期アイデアのテストには適していますが、速度、精度、柔軟性が必要な用途には、通常、コンピュータービジョンの方が適しています。
主なポイント#
しきい値処理は、物体を背景から分離するために迅速かつ簡単に使用できるため、画像処理における重要なツールです。スキャン文書、医用画像、工場での製品欠陥の検査に適しています。
しかし、画像や動画が複雑になるにつれて、画像のしきい値処理などの基本的な画像処理手法では対応が難しくなることがあります。そこで、高度なコンピュータービジョンモデルが役立ちます。Ultralytics YOLO11などのモデルは、より多くのタスクを理解して実行し、一度に多数の物体を検出し、リアルタイムで動作できるため、さまざまなユースケースに役立ちます。
AIについて詳しく知りたいですか。コミュニティとGitHubリポジトリをご覧ください。ソリューションページで、ロボティクスにおけるAIと農業におけるコンピュータービジョンについて学べます。ライセンスのオプションを確認し、今すぐコンピュータービジョンの構築を始めましょう。









