概ね事実
Amazon Web Services(AWS)は、AIエージェントの実行環境「Strands Harness」を公開し、トークンコストを最大28%削減できると発表した。なお、削減率は比較集団の定義に応じて45%または28%という条件付きの数値であり、独立した第三者検証はまだ確立されていない。
公式発表によると、Strands HarnessはAIエージェントの実行時に消費されるトークン量を抑え、運用コストの削減を図る仕組みだ。削減率はベンチマークの比較対象の設定によって45%と28%の数値が示されており、単一の確定値ではない。AWSの公式ブログにベンチマーク結果が埋め込まれて公開されているが、これらの数値に対する外部機関による独立検証は現時点で行われていない。
Strands Harnessは、同社のエージェント向けフレームワーク「Strands Agents」の発表ページを通じて案内されており、大規模言語モデル(LLM)を利用するエージェントの実行環境として位置づけられている。LLMエージェントは反復的な推論処理でトークン消費が増大しやすく、運用コストが課題となっている中での発表となった。
公表された削減率はAWS自身のベンチマークに基づくものであり、比較集団の定義によって結果が異なる条件付きの数値にとどまる。第三者による検証データは現時点で確認されておらず、実際の導入環境での効果は今後の検証に委ねられている。
AWSが公開したStrands Harnessによるトークンコスト削減は、比較条件付きの数値で独立検証が未確立である点を踏まえると、概ね事実と評価できる。
Verdict: 概ね事実