AIエージェントのトレース・評価・本番監視を一元管理するオープンソースのエージェントエンジニアリング基盤。LLM呼び出し・MCP呼び出し・ツール利用・ワークフロー手順を構造化トレースとスパンとして記録し、実行時に何が起きたかをセッション単位で把握できる。品質・信頼性・回帰のメトリクスを測定し、定期評価による本番監視にも対応。主要なエージェントフレームワークやLLMプロバイダーとの連携を備え、セルフホストとクラウドの両方を選択できる。コードを確認・改変できる透明性の高い設計が特徴で、AIエージェントを自社環境でデバッグ・改善したい開発者や小規模チームに適している。
AIエージェントの開発・検証・監視を一気通貫で扱えるオープンソースの観測プラットフォーム。LangChainやLlamaIndexで構築したエージェントのトレーシング機能が核で、複数ステップ推論のどのポイントで判断を誤ったかを数分で特定できる。
編集部レビューの全文 >

