もう少し詳しく

AI開発でいうハーネスは、モデルへの入力を組み立て、モデルが選んだツールを実行し、その結果を次の判断へ戻す仕組みです。権限の扱いや会話・作業状態の管理も担い、モデルが実際に何をできるかに影響します。

ハーネスは、モデル単体を実際の作業環境へ接続する制御層として必要になります。入力の構成、ツール呼び出し、結果の保存、権限、再試行、停止を管理するため、同じモデルでもハーネスの設計で挙動と安全性が変わります。

HISTORY

開発された年代と歴史

この用語を大きな流れで見ると、1960年代〜現在に発展してきました。

  1. 1960〜70年代テスト用プログラムを実行・観測する「test harness」の用法が広がった。
  2. 1990〜2000年代自動テストや組み込み開発で、実行環境と検証コードをまとめる意味が定着。
  3. 2020年代AIエージェントでは、ツール、制約、ログ、評価を囲う実行基盤を指すことがある。

キーマン・関わった研究者

ソフトウェアテスト・組み込み開発の実践者、エージェント基盤開発者

技術の変遷

テスト実行器 → 自動テスト環境 → エージェントの安全な実行基盤

理解のポイント

  • モデルへの入力とツール実行をつなぎ、実行結果を次の判断へ戻す周辺の仕組みです。
  • モデルが同じでも、利用できるツール・権限・状態管理によって実行できる仕事は変わります。
  • ここではエージェントの実行基盤を指します。テスト用の仕組みを指す用法とは文脈を区別します。
FOR EXAMPLE

たとえば、こんな場面で

モデルが「ファイルを読む」と決めたら、権限を確認して読み取りを実行し、内容をモデルへ返します。

覚えておきたいこと

ここではエージェントの実行基盤という意味です。テストを動かす仕組みを指す「テストハーネス」など、別の文脈でも使われます。

参考資料

Microsoft — Understand agent harnesses