Developer Tools
LLM Eval Scorecard
🔒 在瀏覽器中執行
Score LLM outputs manually across accuracy, completeness, instruction following, safety, and clarity.
如何使用此工具
- 在輸入欄位中輸入你要評估的模型輸出。
- 定義或調整評估標準及其權重。
- 對每個維度評分並匯出完成的評分卡。
Overall score
89.1% (B)
4/5 · w3
4/5 · w2
5/5 · w3
5/5 · w2
4/5 · w1
Manual scorecard only. Brevio does not send outputs to an evaluator model or store your notes.
常見問題
- 生成評分卡是否涉及任何外部 LLM 或 API 呼叫?
- 不涉及。評分卡使用完全在您瀏覽器內執行的本機評分標準引擎建構,不會向任何伺服器傳送任何資料。
- LLM 評估評分卡有什麼用途?
- 它為您提供一個結構化框架,根據定義的標準對模型輸出進行評分——適用於一致的人工評估或建構自動化評估的資料集。
- 我可以定義自己的評估標準嗎?
- 可以。您可以新增自訂標準及其說明,並按重要性加權,與預設維度並列使用。
- 我可以匯出評分卡嗎?
- 可以。完成的評分卡可匯出為 JSON,或複製為格式化文字,供試算表或評估管道使用。
將此工具嵌入你的網站
免費。一行 HTML — 工具在訪客的瀏覽器中執行,不會傳送任何資料。
<iframe src="https://brevio.pro/embed/llm-eval-scorecard" width="100%" height="600" loading="lazy" style="border:1px solid #e5e5e5;border-radius:8px" title="LLM Eval Scorecard — brevio"></iframe> <p style="font:12px/1.4 sans-serif"><a href="https://brevio.pro/tools/llm-eval-scorecard">LLM Eval Scorecard</a> by <a href="https://brevio.pro">brevio</a></p>