エージェントハーネスはサンドボックス外に配置すべき

本記事は、LLMベースのエージェントシステムにおけるハーネス(制御・調整層)の配置アーキテクチャについて論じています。エージェントハーネスとは、LLMの出力を解釈し、外部ツールの呼び出しを制御し、実行結果をLLMにフィードバックするコンポーネントです。

本記事は、LLMベースのエージェントシステムにおけるハーネス(制御・調整層)の配置アーキテクチャについて論じています。エージェントハーネスとは、LLMの出力を解釈し、外部ツールの呼び出しを制御し、実行結果をLLMにフィードバックするコンポーネントです。

記事の主要なテーマは、このハーネスをサンドボックス(隔離環境)内で実行すべきか、それとも外側で実行すべきかという重要なアーキテクチャの選択についてです。サンドボックス内での実行はセキュリティ面での利点がある一方で、機能や柔軟性に制限が生じます。

一方、サンドボックス外での実行はより豊富な機能を提供できますが、セキュリティリスクが増加します。コメント欄の議論から浮き彫りになるのは、この領域が急速に進化し、まだ成熟していない段階にあることです。

Anthropic、LangChain、Manusといった複数の企業が6ヶ月~1年の短期間に何度もハーネスアーキテクチャを再設計しており、最適な形がまだ確立されていないことを示唆しています。また、セキュリティとハーネス信頼性のバランス、トークン管理、機密情報保護、スキルとメモリの実装など、複数の技術的トレードオフが存在し、これらがAIエージェントシステムの実装における重要な設計課題であることが強調されています。

HNの反応

セキュリティと機能のバランス、およびハーネス実装の信頼性をめぐって活発な議論が展開されています。複数の大企業が短期間に何度も再設計している事実から、エージェントハーネスアーキテクチャがまだ急速に進化している未成熟な領域であることが明らかになっています。

注目コメント

「他のモデルも存在する。サンドボックスを避けるべきだ。エージェントに完全な機能を備えたコンピュータを与えるが、そのコンピュータを機密リソースから隔離し続ける。トークンは解決済みの問題である:それらをトークン化するか、プロキシで同等のことを実行できる。秘密についても同じことが言える。この投稿の多くは偽のジレンマを提示している。定義上、短命であるか『catt』であるサンドボックスの存在を前提としているが、それは真の選択肢ではない。」— @tptacek

元記事を読むHN討議を見る