ハーネスは、AI のモデルを AI エージェントとして働かせるための枠組みです。最初に読ませる指示、使える道具、作業の進め方、操作の権限、作業の記録などをまとめたものを指します。Anthropic は、AI エージェントを評価することは、ハーネスとモデルの組み合わせを評価することだと説明しています。ハーネスの例に挙げているのは Claude Code です。2025 年 9 月には、Claude Code を動かす枠組みの名前を Claude Agent SDK に改め、ほかの AI エージェントづくりにも使えるものとして案内しています。
同じモデルでも、ハーネスで仕事の進み方が変わります。Anthropic は 2025 年 11 月の技術記事で、性能の高いモデルに大まかな指示だけで長い作業を任せたときの失敗を 2 つ書いています。1 つは、一度に全部を作ろうとして、作りかけのまま次の回に引き継いだことです。もう 1 つは、終わっていないのに完了としたことです。そこで、最初に機能の一覧と進み具合の記録を作らせ、1 回に 1 つずつ進める形に枠組みを変えました。
会社で AI エージェントを使うときも、選ぶのはモデルの名前だけではありません。何を読ませるか、どの道具をどこまで使わせるか、何を人の承認に回すか、何を記録するかを決めることが、ハーネスを整えることにあたります。当社は、Claude Code が作業のたびに読む決まりのファイル(CLAUDE.md)に、送信・削除・本番への反映・金額にかかわる内容は人が承認してから行うと書いています。AI に頼んだ言葉も、そのまま記録に残しています(頼んだ言葉を記録に残す記事)。渡す権限は最小権限の考え方で絞ります。