Developer Tools
LLM Eval Scorecard
🔒 ブラウザで動作
Score LLM outputs manually across accuracy, completeness, instruction following, safety, and clarity.
このツールの使い方
- 評価したいモデルの出力を入力フィールドに入力します。
- ルーブリックの評価基準とその重みを定義または調整します。
- 各次元をスコアリングして完成したスコアカードをエクスポートします。
Overall score
89.1% (B)
4/5 · w3
4/5 · w2
5/5 · w3
5/5 · w2
4/5 · w1
Manual scorecard only. Brevio does not send outputs to an evaluator model or store your notes.
よくある質問
- スコアカードの生成には外部の LLM や API 呼び出しが関与しますか?
- いいえ。スコアカードはブラウザ内で完全に実行されるローカルのルーブリックエンジンを使用して構築されます。サーバーには何も送信されません。
- LLM 評価スコアカードは何のために使用しますか?
- 定義された基準に対してモデルの出力を採点するための構造的なフレームワークを提供します。一貫した手動評価や、自動評価用のデータセット構築に役立ちます。
- 独自の評価ルーブリックを定義できますか?
- はい。説明付きのカスタム基準を追加し、デフォルトの観点と並べて重要度で重み付けできます。
- スコアカードをエクスポートできますか?
- はい。完成したスコアカードを JSON としてエクスポートするか、スプレッドシートや評価パイプラインで使用するためにフォーマットされたテキストとしてコピーできます。
このツールをあなたのサイトに埋め込む
無料。HTML 一行で — ツールは訪問者のブラウザで動作し、データはどこにも送信されません。
<iframe src="https://brevio.pro/embed/llm-eval-scorecard" width="100%" height="600" loading="lazy" style="border:1px solid #e5e5e5;border-radius:8px" title="LLM Eval Scorecard — brevio"></iframe> <p style="font:12px/1.4 sans-serif"><a href="https://brevio.pro/tools/llm-eval-scorecard">LLM Eval Scorecard</a> by <a href="https://brevio.pro">brevio</a></p>