Developer Tools
LLM Eval Scorecard
🔒 Kører i din browser
Score LLM outputs manually across accuracy, completeness, instruction following, safety, and clarity.
Sådan bruger du dette værktøj
- Indtast den modeloutput, du vil evaluere, i inputfeltet.
- Definer eller juster rubrikkriterier og deres vægte.
- Bedøm hver dimension og eksportér det færdige scorecard.
Overall score
89.1% (B)
4/5 · w3
4/5 · w2
5/5 · w3
5/5 · w2
4/5 · w1
Manual scorecard only. Brevio does not send outputs to an evaluator model or store your notes.
Ofte stillede spørgsmål
- Involverer generering af scorecard et eksternt LLM- eller API-kald?
- Nej. Scorecardet bygges ved hjælp af en lokal rubrikmotor, der kører udelukkende i din browser. Intet sendes til nogen server.
- Hvad bruges et LLM eval-scorecard til?
- Det giver dig en struktureret ramme til at bedømme modeloutput ud fra definerede kriterier — nyttigt til konsekvent manuel evaluering eller opbygning af et datasæt til automatiserede evalueringer.
- Kan jeg definere min egen evalueringsrubrik?
- Ja. Du kan tilføje brugerdefinerede kriterier med beskrivelser og vægte dem efter vigtighed ved siden af standarddimensionerne.
- Kan jeg eksportere scorecardet?
- Ja. Det udfyldte scorecard kan eksporteres som JSON eller kopieres som formateret tekst til brug i regneark eller evalueringspipelines.
Indlejr dette værktøj på dit websted
Gratis. Én linje HTML — værktøjet kører i din besøgendes browser, ingen data sendes.
<iframe src="https://brevio.pro/embed/llm-eval-scorecard" width="100%" height="600" loading="lazy" style="border:1px solid #e5e5e5;border-radius:8px" title="LLM Eval Scorecard — brevio"></iframe> <p style="font:12px/1.4 sans-serif"><a href="https://brevio.pro/tools/llm-eval-scorecard">LLM Eval Scorecard</a> by <a href="https://brevio.pro">brevio</a></p>