技術ガイド
AIエージェントのアーキテクチャ:信頼できるワークフローの構成要素

AIエージェントのアーキテクチャは、モデルの周囲に構築するソフトウェアです。状態、検索、ツール、オーケストレーション、安全性、評価を含みます。優れたアーキテクチャは、不確実性や失敗を会話画面の裏に隠さず見える状態にします。
調査と開示: アーキテクチャの説明は次の公式資料を参照しています:OpenAI, Anthropic, LangChain, NIST。2026年9月2日に確認しました。
参照レイヤー
| レイヤー | 役割 | 設計上の質問 |
|---|---|---|
| インターフェース | 目標を受け取り状態を表示 | ユーザーは何を承認するのか? |
| オーケストレーター | 手順、再試行、停止を制御 | すべての遷移を記録できるか? |
| モデル | コンテキストを解釈し行動を提案 | 必要な出力スキーマは? |
| コンテキスト | ファイル、メモリ、状態を取得 | 取得前に権限を適用しているか? |
| ツール | 外部操作を実行 | 呼び出しは限定され冪等か? |
| 評価 | 品質と安全性を測定 | どの失敗がリリースを止めるか? |
状態とメモリ
実行中だけ必要な状態と、プロジェクトの永続メモリを分けます。取得した事実には出典とタイムスタンプを保存します。レビューや出典ポリシーなしに、以前のモデル回答を公式な記憶として扱わないでください。
アーキテクチャとワークフローの違いは、エージェント型ワークフローのガイドも参照してください。アーキテクチャはシステムの境界、ワークフローは実行する順序立った仕事を表します。
ツールの境界
無制限の資格情報ではなく、範囲を限定した関数を公開します。引数を検証し、タイムアウトを設定し、送信、削除、購入、権限変更には確認を求めます。冪等キーを使い、再試行で副作用が重複しないようにします。
検索とグラウンディング
ユーザーがアクセスできる内容だけを取得します。出典IDをコンテキストに含め、出力には引用や根拠のフィールドを必須にします。結果が空または矛盾する場合は、推測で埋めずにエスカレーション状態を返します。
取り消せる範囲から始める
書き込み権限を追加する前に、読み取り中心のタスクを試作します。出典に基づくブリーフや分類結果なら、不可逆なリスクを負わずに有用な実行記録を得られます。ツールは1つずつ追加し、権限の境界を記録してください。
リクエストとレスポンスの契約
各レイヤー間の契約を定義します。リクエストには目標、ユーザーID、許可された出典、予算を含め、レスポンスには状態、構造化された出力、引用、ツール呼び出し、レビューが必要な項目を含めます。
{
"status": "needs_review",
"claims": [],
"sources": [],
"open_questions": ["承認済みデータセットに最新四半期がありません。"]
}明示的な状態は、情報源の不足を隠す流暢な文章より安全です。
評価と運用
通常、不完全、攻撃的、多言語のケースをテストセットに含めます。ツールエラー、エスカレーション率、遅延、コスト、レビューでの修正を追跡します。プロンプト、ツール、モデル設定、ポリシーをまとめてバージョン管理します。
本番チェックリスト
- すべての呼び出しとモデル版を再生できるトレース
- テストと本番で分けた資格情報とデータ
- 冪等な書き込みと文書化されたロールバック
- プロンプトやモデル変更前の評価ケース
- エスカレーションとインシデントの担当者
同期・非同期処理と人のチェックポイント
短い分類は同期処理で構いません。長い検索や文書生成は進捗表示とキャンセルを備えた非同期処理にします。取り消せない操作の前、および信頼度、権限、ポリシーの確認に失敗したときは人の承認を入れます。再試行でも文脈を保てるよう判断を実行状態に保存します。
コストと遅延の予算
モデルのターン数、ツール呼び出し、トークン、総時間に上限を設けます。単純な抽出は小さなモデルに任せ、高価な推論は曖昧なケースに限定します。予算は運用制御であると同時に、いつ停止して支援を求めるかを利用者に示します。
よくある質問
マルチエージェント構成は必要ですか?
いいえ。まず1つのエージェントと明確なツールから始めます。役割、権限、評価基準が本当に異なる場合だけ増やします。
セキュリティはどこに置きますか?
すべてのレイヤーです。ID、検索、ツール権限、秘密情報、ログ、人による承認を含みます。最後に追加する項目ではありません。
ハルシネーションを減らすには?
情報源を改善し、出力を制約し、根拠を必須にし、不確実性をレビュー行動につなげます。プロンプトだけでは不十分です。
最初に何を試作すべきですか?
担当レビュー者が明確な、限定的で取り消せるワークフローです。ツールを増やす前に制御経路を検証します。
