Harness Tax(ハーネス・タックス)とは

Harness Taxとは、AIモデルをエージェントとして動かすハーネスが上乗せするトークンと実行費用を「税」に例えた用語です。モデルの単価が同じでも、システム指示、ツール定義、履歴、再試行によって、一件の仕事に必要な量は変わります。2026年7月に公開された実測記事が、この差を測って名づけました。

何がコストを増やす?

コーディングエージェントは、利用者の依頼だけをモデルへ送るわけではありません。行動規則を書いたシステムプロンプト、ファイル編集やコマンド実行のツール定義、承認ルール、過去の会話とツール結果を付け加えます。この実測では、同じ問題を生のAPIへ直接送ったときの入力が400〜1,000トークンだったのに対し、エージェント経由では1回あたり3万6,000〜7万1,000トークンに達しました。画面には見えない「仕事を始めるための説明書」まで課金対象で、しかも作業が1ターン進むたびに読み直されます。

どうやって測る?

モデル、問題、思考の設定をそろえ、生のAPIへ一度だけ送った場合と、エージェント経由の場合を比べます。入力、出力、キャッシュの作成・読み取りを全ターン分合計した差が、その税額。2026年7月の公開実測(Claude Code 2.1.201、新しく作った5問、Opus 4-6・4-8とSonnet 5)では、文脈が40〜125倍、1回あたりの費用が5〜8倍になりました。外れ値も出ています。ある1モデルは「ファイルを書いたら止まる」条件で3回中2回その指示を守らず13ターン続け、最大で約102万トークン、1回約2.94ドルを使いました。同じ問題を生のAPIで解けば約5セントです。これらは特定の問題・モデル・バージョンでの結果であり、すべてのエージェントに共通する定数ではありません。

導入判断で何を見る?

Harness Taxが小さいことだけでツールを選ぶと、テストや再試行が減り、失敗が増える可能性があります。比べるのは、固定的に送るトークン、1件あたりの総コストと遅延、成功率、人の修正時間、必要な権限。「最安の1ターン」ではなく、「検証済みの結果を1件得るコスト」で比較します。失敗した回の費用まで数えると、成功率が上がるモデルでは高いほうが安くつくこともあります。ただし、この比べ方が成り立つのは小さく閉じた仕事だけ。大きなコードベースを相手にする仕事では生のAPI1回という選択肢がそもそもなく、Harness Taxは値切る対象ではなく参加費になります。

Topic「税」と「リフト」はセットで測る

Harness Taxを定義した実測は、ハーネスによる成功率の変化をHarness Liftと呼び、費用の差と分けました。意外なのはその中身です。テストの実行も結果の確認も許さず、ファイルを1つ書いて止まるだけに絞った条件、つまりモデルに新しい能力を何も足していない条件で、Opus 4-8の正答率は72%から100%へ、28ポイント上がりました。もともと高かったOpus 4-6は1ポイント、100%だったSonnet 5は変化なし。効いたのは道具ではなく、システムプロンプトと「ファイルに書く」という形式だけだった、という結果です。

Harness Taxに関するよくある質問

Harness Taxはコンテキストウィンドウの大きさと同じですか?
違います。ウィンドウは一度に扱える上限で、Harness Taxはハーネスが実際に追加した文脈と実行回数から生じるコストです。
短い依頼でもHarness Taxは発生しますか?
発生します。システム指示やツール定義は依頼文の長さと関係なく付与されるため、小さな作業ほど比率が大きく見える場合があります。
Harness Taxはどう減らせますか?
使わないツール定義、重複する指示、不要な履歴と再試行を見直します。削減後は、同じタスクの成功率と人の修正時間が悪化しないか再測定します。

あわせて読みたい記事