プロダクトtldr-ai2026-07-01
AIの評価を簡単にする新機能
Evals belong where your code runs

新機能「Agent Evals」により、AI(エージェント)の性能評価が、実際のビジネス結果に基づいて簡単にできるようになりました。評価にかかる時間と手間を大幅に削減できます。
エージェントの性能を評価することは、本来よりも難しいものです。特に、数日後に発生する可能性のある重要なイベントを待つ必要がある場合はなおさらです。
Agent Evalsがその問題を解決します。既存のコードをラップし、実行時に既に収集されたデータを使用するだけで、実際ビジネスの成果に基づいてエージェントを評価できます。無料で試す。
この記事について質問
記事の内容に答えます。記事外のことは都度ウェブで調べます。