Agent Harness
AIエージェントハーネスとは何か、ツール、メモリ、安全性、ワークフローをどのように管理するか、そしてYOLO26が信頼性の高いコンピュータビジョンエージェントをどのように支援するかを学びます。
エージェントハーネスとは、基盤モデルを実用的なAIエージェントに変えるソフトウェア層です。モデルを指示、ツール、メモリ、実行ループ、権限、検証、監視で取り囲みます。LangChainのエージェントハーネスの構造に基づく簡潔な捉え方では、モデルが知性を提供し、ハーネスがその知性を利用可能にします。この違いが重要なのは、信頼性の高いエージェントワークフローが、モデルの品質だけに依存するものではないためです。(langchain.com)
エージェントハーネスの仕組み#
ハーネスは、モデルにコンテキストを繰り返し与え、その応答を解釈し、承認済みのアクションを実行して、次の判断のために結果を返します。一般的なコンポーネントには、次のものがあります:
- 指示とコンテキスト: エージェントの役割、利用可能な情報、制約、完了条件を定義します。
- ツール実行: Model Context Protocolツールなどのインターフェースを通じて、モデルをAPI、データベース、コードインタープリター、ビジョンモデルに接続します。
- 状態とメモリ: 複数のステップやセッションにわたり、計画、観察結果、ファイル、過去のアクションを保持します。
- 制御フロー: リトライ、分岐、サブエージェント、タイムアウト、トークン予算、停止条件を管理します。
- トレーシングと評価: OpenAI Agents SDKのトレーシングなどの機能を使用して、判断とツール呼び出しを記録します。
- 安全性制御: OpenAIエージェントのガードレールなどの仕組みを通じて、権限、入力チェック、出力検証、人による承認を適用します。
再利用可能な構成要素を提供するエージェントSDKとは異なり、ハーネスは特定のアプリケーション向けに設定されたランタイム動作です。また、ツール接続を標準化するMCPや、エージェント間の通信に焦点を当てたGoogleのAgent2Agentプロトコルとも異なります。(modelcontextprotocol.io)
エージェントハーネスが重要な理由#
エージェント構築に関するOpenAIのガイドとAnthropicの効果的なエージェントに関するガイダンスでは、シンプルで組み合わせ可能なパターンから始めることが推奨されています。実際、適切に設計されたハーネスは、モデルの重みを変更することなく、ルーチンの状態管理を外部化し、検証を追加することで信頼性を向上させられます。最近の研究では、編集可能な自然言語ハーネス、Meta-Harnessによる自動最適化、HarnessXによる適応的な構成が検討されています。(arxiv.org)
コンピュータービジョンの例#
ビジョンエージェントでは、Ultralytics YOLO26を知覚ツールとして使用し、決定論的なハーネスロジックによって次の処理を決定できます:
from ultralytics import YOLO
model = YOLO("yolo26n.pt")
results = model("https://ultralytics.com/images/bus.jpg")
labels = {results[0].names[int(cls)] for cls in results[0].boxes.cls}
action = "Send alert" if "person" in labels else "Continue monitoring"
print(action)この例では、モデルに無制限の制御を許可するのではなく、YOLOのpredictモードと明示的な判断ルールを組み合わせています。
実世界での利用例#
- 製造現場の外観検査: ハーネスがカメラ画像を取得し、欠陥検出を実行し、信頼度のしきい値を確認し、保守チケットを作成して、不確実なケースでは人によるレビューを要求します。
- 待ち行列管理: ビジョンエージェントが人数を数え、待ち時間を追跡し、設定可能な収容人数と時間の上限を超えた場合にのみスタッフへ通知します。
チームは、Ultralytics Platformを使用して、データセットへのアノテーション付与、専用ビジョンモデルのトレーニング、エンドポイントのデプロイ、これらのワークフロー内での監視を行えます。
ベストプラクティス#
ツールの範囲を限定し、取り消し不能なアクションには承認を必須とし、リトライをべき等にして、構造化出力を検証し、最終回答だけでなく一連の軌跡全体をテストしてください。OWASPのエージェントアプリケーションのリスクと、策定が進むNIST AIエージェント標準に従ってください。OpenHarnessなどのオープン実装は、モジュール式の権限、フック、メモリ、ツール、マルチエージェント連携についても示しています。(genai.owasp.org)









