AI エージェントがあなたの MCP ツールを正しく選び、正しく呼べているかを測り、直すべき点を示します
Forecall は、MCP サーバーや API の提供者向けに、ツールが AI エージェントに正しく選ばれ、正しく呼ばれているかを測り、直すための基盤です。 いま使えるのは、ツールの説明文を採点する静的リンターです。tools/list の JSON を貼るだけで、ツールごとの点数(100 点満点)と内訳、直すべき点、AI が取り違えやすいツールの組がわかります。無料で、登録は要りません。手元で採点する CLI(npx forecall lint <file>)もあり、こちらは通信せずに Web と同じ点と指摘を出します。 公式や有名な MCP サーバー 8 つ(計 126 ツール)を採点したところ、平均点は 100 点中 33〜70 点でした。Notion の公式サーバーだけでも、AI が取り違えやすいツールの組が 57 組ありました。 これから出す機能 ・Evaluations: 実際のモデル(Claude、GPT、Gemini)で、ツールが正しく選ばれ、正しく呼ばれる割合を測ります ・Failure KB: ツール呼び出しの失敗と回避策の記録です。別のチームが再現できたものだけを「検証済み」にします