Developer Tools
LLM Eval Scorecard
🔒 Działa w Twojej przeglądarce
Score LLM outputs manually across accuracy, completeness, instruction following, safety, and clarity.
Jak używać tego narzędzia
- Wprowadź wynik modelu, który chcesz ocenić, w polu wejściowym.
- Zdefiniuj lub dostosuj kryteria rubryki i ich wagi.
- Oceń każdy wymiar i wyeksportuj wypełnioną kartę oceny.
Overall score
89.1% (B)
4/5 · w3
4/5 · w2
5/5 · w3
5/5 · w2
4/5 · w1
Manual scorecard only. Brevio does not send outputs to an evaluator model or store your notes.
Często zadawane pytania
- Czy generowanie karty wyników wiąże się z jakimkolwiek zewnętrznym modelem językowym lub wywołaniem API?
- Nie. Karta wyników jest budowana przy użyciu lokalnego silnika rubryk działającego całkowicie w Twojej przeglądarce. Nic nie jest wysyłane na żaden serwer.
- Do czego służy karta wyników oceny modelu językowego?
- Daje ustrukturyzowane ramy do oceniania wyników modelu według zdefiniowanych kryteriów — przydatne do spójnej ręcznej oceny lub budowania zbioru danych do automatycznych ewaluacji.
- Czy mogę zdefiniować własną rubrykę oceny?
- Tak. Możesz dodawać niestandardowe kryteria z opisami i ważyć je według ważności obok domyślnych wymiarów.
- Czy mogę wyeksportować kartę wyników?
- Tak. Wypełnioną kartę wyników można wyeksportować jako JSON lub skopiować jako sformatowany tekst do użycia w arkuszach kalkulacyjnych lub potokach ewaluacji.
Osadź to narzędzie na swojej stronie
Za darmo. Jedna linia HTML — narzędzie działa w przeglądarce odwiedzającego, żadne dane nie są wysyłane.
<iframe src="https://brevio.pro/embed/llm-eval-scorecard" width="100%" height="600" loading="lazy" style="border:1px solid #e5e5e5;border-radius:8px" title="LLM Eval Scorecard — brevio"></iframe> <p style="font:12px/1.4 sans-serif"><a href="https://brevio.pro/tools/llm-eval-scorecard">LLM Eval Scorecard</a> by <a href="https://brevio.pro">brevio</a></p>