Developer Tools
LLM Eval Scorecard
🔒 브라우저에서 실행
Score LLM outputs manually across accuracy, completeness, instruction following, safety, and clarity.
사용 방법
- 입력 필드에 평가할 모델 출력을 입력하세요.
- 루브릭 기준과 가중치를 정의하거나 조정하세요.
- 각 항목에 점수를 부여하고 완성된 스코어카드를 내보내세요.
Overall score
89.1% (B)
4/5 · w3
4/5 · w2
5/5 · w3
5/5 · w2
4/5 · w1
Manual scorecard only. Brevio does not send outputs to an evaluator model or store your notes.
자주 묻는 질문
- 스코어카드 생성에 외부 LLM이나 API 호출이 포함되나요?
- 아닙니다. 스코어카드는 브라우저 내에서 완전히 실행되는 로컬 루브릭 엔진을 사용하여 구축됩니다. 어떤 서버로도 전송되지 않습니다.
- LLM 평가 스코어카드는 무엇에 사용되나요?
- 정의된 기준에 따라 모델 출력을 채점하는 구조적 프레임워크를 제공합니다. 일관된 수동 평가나 자동화된 평가를 위한 데이터셋 구축에 유용합니다.
- 나만의 평가 루브릭을 정의할 수 있나요?
- 네. 설명이 있는 사용자 정의 기준을 추가하고 기본 항목과 함께 중요도에 따라 가중치를 부여할 수 있습니다.
- 스코어카드를 내보낼 수 있나요?
- 네. 완성된 스코어카드는 JSON으로 내보내거나 스프레드시트 또는 평가 파이프라인에 사용하기 위해 서식화된 텍스트로 복사할 수 있습니다.
이 도구를 사이트에 삽입하기
무료. HTML 한 줄이면 됩니다 — 도구는 방문자의 브라우저에서 실행되며 데이터는 어디에도 전송되지 않습니다.
<iframe src="https://brevio.pro/embed/llm-eval-scorecard" width="100%" height="600" loading="lazy" style="border:1px solid #e5e5e5;border-radius:8px" title="LLM Eval Scorecard — brevio"></iframe> <p style="font:12px/1.4 sans-serif"><a href="https://brevio.pro/tools/llm-eval-scorecard">LLM Eval Scorecard</a> by <a href="https://brevio.pro">brevio</a></p>