仕組み

Dejev は 1 回の API 呼び出しを薄く包んだビジュアルラッパーです。結果ページ上のすべては 1 回の POST /v1/systemone から来ています。

リクエストの全体

state はあなたが渡すもの、つまり貼り付けたテキストです。質問はレンズが渡します。Jev は質問ごとに型のある答えを、同じ id をキーにして返します。

{
  "state": "Help! My payouts have been failing for 3 days.",
  "model": "jev-latest",
  "questions": {
    "is_urgent":  { "type": "noul",   "instructions": "Does this convey urgency?" },
    "department": { "type": "choice", "instructions": "Which team should handle this?",
                    "criteria": { "billing": "Payments, invoicing, refunds",
                                  "technical": "Bugs, outages, integrations",
                                  "sales": "Pricing, upgrades, new accounts" } },
    "frustration":{ "type": "score",  "instructions": "How frustrated is the customer?",
                    "criteria": ["Calm", "Frustrated", "Very angry"] }
  }
}

図と答えの対応

Choice → ドーナツ
確率の合計は 1 なので、ここではリングが誠実です。本当に部分と全体の関係だからです。凡例はすべての選択肢を正確な値つきで繰り返します。ドーナツは僅差の表現が苦手で、数字は得意だからです。
Score → ルーブリック帯
帯はあなたのレベルを順に並べたもの。針は確率で重み付けした値なので、たいてい 2 つのレベルの間に落ちます。下のバーは確率の質量がどう広がっているかを示します。鋭いピークから出た 2.0 と、離れた 2 つの山から出た 2.0 は、まったく別の答えです。
Noul → メーター
上限に対する 1 つの比率なので、チャートではなくメーターになります。真ん中のグレーの帯は、モデルが事実上「わからない」と言っている範囲です。0.51 を「はい」と読んではいけません。

レンズ

レンズは、Jev にできることの別々の側面を見せるために選ばれた固定の質問セットにすぎません。自分で書くこともできます。

  • メッセージ X 線

    このメッセージは、実際にあなたに何を求めていますか?

    9 個の質問

  • サポート仕分け

    人が開く前にチケットを振り分ける。

    9 個の質問

  • ガードレール

    プロンプトがモデルに届く前にふるいにかける。

    9 個の質問

  • 下書き批評

    送る前に、下書きへの 9 つの読み取り。

    9 個の質問

  • レビュー解読

    顧客レビューが本当に伝えていること。

    9 個の質問

  • バグ報告の仕分け

    深刻度、コンポーネント、そして誰かが再現できるか。

    9 個の質問

  • 見出しレンズ

    ニュースがどう枠づけられているか。

    9 個の質問

  • ピッチ点検

    投資家や顧客は読み続けるでしょうか?

    9 個の質問

よくある質問

システム 1 モデルとは何ですか?
散文ではなく判断のために作られたモデルです。Jev は 1 つの state と型のある質問のマップを受け取り、質問ごとに 1 つの型のある答えを返します。トークンのストリームもなく、パースするものもなく、あなたが定義した集合の外の値を出す方法もありません。TypeSafe の整理では、素早い構造化された判断がシステム 1、本当に言語が必要なときの普通の LLM がシステム 2 です。
なぜすべてが 1 回のリクエストで動くのですか?
Jev は state を一度だけ取り込み、すべての質問をそれに対して並列に評価します。10 個の質問を 1 回の呼び出しに入れても、入力トークンはおよそ 1 回分で済み、所要時間も 1 回分とほぼ同じです。ここのレンズがプロンプトを連鎖させず 9 個を一度に聞くのは、そのためです。
確信度とは何を意味しますか?
Choice と Score の答えは、確率分布から導かれた確信度を持ちます。分布が集中していれば確実、広がっていればモデルは選択肢を分離できていません。これは第 2 の軸です。答えは「何か」を、確信度は「動くべきか」を教えます。Noul に確信度フィールドがないのは、確率そのものがそれを担っているからです。0.51 は、モデルが「わからない」と言っているということです。
Jev はハルシネーションを起こしますか?
出力の形については起こしません。Choice はあなたが定義した選択肢しか返せず、Score はあなたのルーブリックの中にしか落ちず、Noul は 0 と 1 の間の数です。テキストの読み取りを誤ることはあります。確信度はまさにそのためにあります。
なぜ Jev という名前なのですか?
経済学者ウィリアム・スタンレー・ジェヴォンズにちなんでいます。TypeSafe のローンチ記事によれば、蒸気機関が効率化したあとに石炭がたどった道を機械知能もたどると考えているとのこと。つまりジェヴォンズのパラドックス。何かを使うのが安くなると、使われる量は減るどころか増えるというものです。
Jev をローカルで動かせますか? オープンソースですか?
いいえ。Jev は TypeSafe の HTTP API 経由で使うプロプライエタリなホスト型モデルです。ダウンロードできる公開された重みはなく、すべてのアカウントが同じ重みを使います。顧客ごとのファインチューニングや LoRA 適用もありません。答えを形づくるのはリクエストのほうです。state に何を入れるか、各質問の instructions と criteria をどう書くか。
Jev はどれくらい速いですか?
TypeSafe はエンドツーエンドで 70〜500 ms、フロンティアモデルの 3〜329 秒に対して、得意なクエリでは 40〜200 倍速いとしています。これはベンダー自身の数字です。このサイトが自分のログから言えるのは、9 問のリクエストがたいてい数百ミリ秒で返ってくるということ。結果ページにはその呼び出しで実測した往復時間が出ています。
Jev の料金は?
jev-1.13.0 で入力 100 万トークンあたり $0.042、出力は無料です。計測すべき自己回帰デコーディングがないからです。state は一度だけ読まれ、すべての質問が並列に評価されるので、10 個聞いても 1 個とほぼ同じコストです。このサイトの各結果ページには、その呼び出し自体のトークン数とコストが表示されます。
Jev はどう訓練されたのですか?
TypeSafe が RLCD と呼ぶ手法 — 較正された判断のための強化学習です。掲げる目標は RLHF や RLVR とは異なります。人が好む答えでも、チェッカーを通る答えでもなく、確率が認識論的に誠実である答えを目指す。確信度が飾りではなく、しきい値として使うに値するのはそのためです。
制限は何ですか?
テキストのみで、画像・音声・動画は扱えません。1 リクエスト 64k トークン、そのうち state と最長の質問 1 つが 32k に収まる必要があります。Choice は最大 255 個の選択肢、Score は 2〜10 レベル。早期アクセスのレート制限は毎秒 250,000 トークン、毎分 1,200 リクエストで、TypeSafe はこれが変わると注意しています。
貼り付けたテキストはどうなりますか?
評価のために TypeSafe に送られ、結果に恒久的なリンクを持たせるためこのサイトのデータベースに保存されます。公開した実行は「探す」と検索エンジンに出ます。限定公開の実行も保存されますが、「探す」とサイトマップからは外れ、noindex ヘッダーつきで配信されます。リンクを渡した相手には引き続き見えます。いずれにせよ機微な情報は貼らないでください。これは公開デモです。
このサイトは何語を話しますか?
インターフェース、レンズのライブラリ、各解説ページは 32 言語で公開されています。ヘッダーから選ぶか、ブラウザの言語設定に従います。貼り付けた内容はそのまま保たれ、Jev はそれが書かれている言語のまま読みます。各レンズの背後にある質問はどの言語でも英語で送られるので、どの言語で実行しても 1 回の実行の意味は同じです。
これは TypeSafe が運営していますか?
いいえ。Dejev は、Jev の出力を図にするとどう見えるかを示すために作られた独立のデモです。モデル、API、ドキュメントは TypeSafe のものです。

さらに深く

モデル、価格、ざらついた部分、そして長い棚いっぱいのクックブックは、すべて TypeSafe 自身のドキュメントにあります。