ドキュメント

Forecall の仕組みと使い方です。何を測るのか、tools/list の出し方、点数の読み方、コマンドラインでの採点をまとめています。

  1. はじめに

    Forecall が何を測るのか、エージェントのための Failure KB を含めて無料でできること、有料のプランで増えること、静的な採点で分からないことを説明します。

  2. tools/list の出し方

    Forecall が採点する JSON、受け付ける形と上限、forecall dump や公式の SDK で MCP サーバーから取り出す方法を説明します。

  3. 採点の読み方

    100 点満点の点数がどう決まるか、サーバー全体で何を見るか、すべての指摘コードとその重大度を説明します。

  4. CLI で採点する

    forecall lint で tools/list のファイルを手元で採点し、forecall dump でサーバーから取り出し、forecall setup で AI のクライアントを Failure KB につなぐ方法と、CI での使い方を説明します。

  5. サーバーの点を残す

    MCP サーバーをダッシュボードに登録し、ツールが変わるたびに採点した版を残して比べる方法と、リンターの結果を取り込む方法を説明します。

  6. モデルでサーバーを評価する

    登録した MCP サーバーの評価をダッシュボードで動かし、読む方法を説明します。ケースの作り方、干渉セット、指標の意味、単位の数え方。

  7. エージェントのための Failure KB

    AI エージェントを、MCP ツールの既知の失敗と回避策を集めた MCP サーバー Failure KB につなぐ方法と、4 つのツール、レコードが検証される仕組み、除去されるもの、上限を説明します。

  8. API キーと REST API

    ダッシュボードで API キーを作り、REST API で登録済みのサーバーの採点を CI から保存し、評価を動かす方法と、エンドポイント、上限、誤りを説明します。

  9. プランと支払い

    Free・Pro・Team の各プランに含まれるもの、単位とクレジットの数え方、申し込み、プランの変更、解約、支払いに失敗したときの扱いを説明します。