Albert zhang

私たちは自社課題を解決するためにAgentForgeを構築しました。本番環境でのマルチエージェント運用6ヶ月から得られた教訓をお伝えします。

Lesson 1: 成功ケースではなく、失敗モードから始める

誰もがハッピーパスを設計しようとします。しかし、マルチエージェントシステムでは失敗モードが倍増します:

  • Agent Aは成功したが30秒かかった → Agent Bは待機中にタイムアウト
  • Agent Aが不正なJSONを返した → Agent Bがパース中にクラッシュ
  • 2つのエージェントが同じファイルに書き込もうとした → 競合状態

最初に「何が壊れるか」を考慮してオーケストレーションを設計する。

Lesson 2: 観測可能性はオプションではない

エージェントごとの実行トレースが必要です。ログだけでなく、以下を示す構造化されたトレース:

  • 入力パラメータ(要約ではなく実際の値)
  • 後処理前の出力
  • バックオフ付きのリトライ試行
  • サーキットブレーカー状態遷移

これをAgentForgeの実行エンジンに組み込みました。すべての実行で、デバッグ用にリプレイ可能なJSONトレースが生成されます。

Lesson 3: エージェントにはメモリが必要だが、無限のメモリは不要

無制限の会話履歴はパフォーマンスを低下させます。私たちはスライディングウィンドウ+要約戦略を採用しています:

  • 直近Nターンはそのまま保持
  • 古いターンは構造化されたコンテキストに要約
  • エージェントが重要な事実を明示的に「記憶」できるようにメモリストアを用意

Lesson 4: コスト最適化はアーキテクチャ

5つのエージェント×4Kトークン×GPT-4の実行はすぐに高額になります。私たちのアプローチ:

  • ルーターエージェントがどの専門エージェントを呼び出すかを判断(安価なモデル)
  • 専門エージェントは必要時のみ大規模モデルを使用
  • 決定論的クエリに対するレスポンスキャッシング

結果:ナイーブな実装と比べて60%のコスト削減。

The Stack

  • Python 3.11+
  • Pydantic for schema validation
  • AsyncIO for concurrent agent execution
  • SQLite/Redis for state persistence
  • WebSocket for real-time monitoring UI

オープンソース。VC向けピッチなし。動作するコードのみ。

https://github.com/agentforge-cyber/agentforge-mvp

Join us: https://discord.gg/Qy6HKHsqP


Posted on 2026-08-01 by the AgentForge team.