Score — оцінка за шкалою в Jev

Score — один із трьох типів запитань у моделі Jev від TypeSafe. Він оцінює вхід за впорядкованими рівнями, які пишете ви, і повертає зважене за ймовірностями значення, здатне потрапити між двома рівнями.

Score — це шкала. Ви пишете рівні по порядку, від найнижчого, словами, і відповідь — позиція на цій шкалі, пронумерована з 0. Оскільки це зважене за ймовірностями середнє рівнів, воно може потрапити — і часто потрапляє — між двома з них.

Описуйте рівні, а не нумеруйте їх. Власна документація TypeSafe показує, як той самий вхід чисто оцінюється за трьома описаними рівнями і як імовірність розщеплюється, якщо дати голі числа: без того, з чим звіритися, моделі немає від чого міркувати.

Справжня відповідь

Надіслано до jev-1.13.0. Числа нижче — це те, що повернулося.

State

Починаючи з 4.2.0 експорт у CSV мовчки обривається на 1000 рядків. Помилка не показується. Відкат версії допомагає. Відтворено на двох облікових записах. Це ламає нам закриття місяця.

Запитання

Наскільки серйозна ця проблема?

70%
середня
2.35 з 4 · Серйозно, зламано робочий процес

2,35 стоїть трохи далі за «зламано робочий процес», але читайте розподіл, а не число. 77% лежать на рівні 2, і все ж 13% залізли на рівень 4, бо мовчазне обрізання справді може бути втратою даних. Середнє 2,35 і вузький пік на 2,35 — різні відповіді, і розрізняє їх лише `probabilities`.

Запит і відповідь дослівно
Запит
{
  "state": "CSV export silently truncates at 1000 rows since 4.2.0. No error shown. Downgrading fixes it. Reproduced on two accounts. This breaks our month-end close.",
  "model": "jev-latest",
  "questions": {
    "severity": {
      "type": "score",
      "instructions": "How severe is this issue?",
      "criteria": [
        "Cosmetic",
        "Minor, has a workaround",
        "Major, a workflow is broken",
        "Critical, core functionality is unusable",
        "Catastrophic, data loss or a security hole"
      ]
    }
  }
}
Відповідь
{
  "model": "jev-1.13.0",
  "answers": {
    "severity": {
      "type": "score",
      "score": 2.35,
      "confidence": 0.7,
      "legend": {
        "0": "Cosmetic",
        "1": "Minor, has a workaround",
        "2": "Major, a workflow is broken",
        "3": "Critical, core functionality is unusable",
        "4": "Catastrophic, data loss or a security hole"
      },
      "probabilities": {
        "0": 0,
        "1": 0,
        "2": 0.77,
        "3": 0.1,
        "4": 0.13
      }
    }
  }
}

Що містить відповідь

type "score"
Збігається з типом запитання.
score number
Зважене за ймовірностями середнє номерів рівнів. Для п’яти рівнів — від 0 до 4, і може потрапляти між рівнями.
legend map<string, string>
Кожен номер рівня, зіставлений назад із написаним вами описом.
probabilities map<string, number>
Кожен рівень із його ймовірністю. У сумі — 1.
confidence number
Від 0 до 1. Поодинокий пік на одному рівні — висока; імовірність, розмазана по рівнях, — низька.

Правила та обмеження

  • criteria — впорядкований масив описів рівнів, знизу вгору. Потрібно щонайменше два рівні, щонайбільше десять.
  • Номер рівня — це його позиція в масиві, починаючи з 0.
  • Різні розподіли дають той самий бал: 1,0 може означати, що вся ймовірність лежить на рівні 1, або що вона порівну поділена між рівнями 0 і 2. Читайте поруч probabilities і confidence.

Беріть Score, коли

  • Відповіді — щаблі однієї драбини: серйозність, терміновість, роздратування, якість, ризик.
  • Потрапляння між двома рівнями — це інформація, а не проблема.
  • Ви хочете скласти кілька оцінок із вагами, якими керуєте самі, замість одного розпливчастого запитання про загальну якість.

Візьміть інше, коли

  • Варіанти не впорядковані. Для невпорядкованих категорій чесна форма — Choice.
  • Ви не можете описати рівні окремо. Візьміть стільки, скільки можете описати, і жодним більше: неописані рівні не дають моделі того, з чим звірятися.

Два інші

Поставте Score власному тексту

Майданчик надсилає до Jev усе, що ви вставите, і малює кожну відповідь. Без облікового запису й без ключа.

Відкрити майданчик