Vad är Jev?

Jev är en beslutsmodell. Där en språkmodell skriver text som du sedan måste tolka tar Jev emot en text plus en karta av typade frågor och returnerar ett typat svar per fråga — en sannolikhet, ett namngivet alternativ eller en position på en skala — vart och ett med ett kalibrerat tal fäst vid sig. Den byggs av TypeSafe, nås över ett HTTP-API och kan inte returnera ett värde utanför den mängd du definierat.

Varför den inte är en språkmodell

En språkmodell producerar tokens; formen på det som kommer tillbaka är ett hopp, inte en garanti, och därför slutar applikationer som använder den för beslut inlindade i tolkning och omförsök. Jev producerar ett värde av den typ du angav. Det finns inget att tolka och inget trasigt fall att hantera — det som ersätter omförsöksloopen är en helt annan gren: den som utlöses när modellen är osäker, vilket är något annat och betydligt nyttigare att veta.

Jev mot en språkmodell →

Tre former, och inget annat

Siffrorna

TypeSafe publicerar dem; det är leverantörens egna tal, inte våra mätningar.

70–500 ms

svarstid ände till ände, mot 3–329 s för frontlinjemodeller

0,042 $

per miljon indata-tokens, utdata gratis

64k tokens

kontext per förfrågan

gratis

utdata-tokens

Frågor

Vad är en System One-modell?
En modell byggd för beslut snarare än prosa. Jev tar ett tillstånd plus en karta av typade frågor och returnerar ett typat svar per fråga — inga strömmade tokens, inget att tolka och ingen möjlighet att ge ett värde utanför den mängd du definierat. TypeSafes ram är System One för snabb strukturerad bedömning, med en vanlig språkmodell som System Two när du faktiskt behöver språk.
Vad betyder tillförsikt?
Choice- och Score-svar bär ett tillförsiktsvärde härlett ur sin sannolikhetsfördelning: koncentrerad betyder säker, utspridd betyder att modellen inte kan skilja alternativen åt. Det är en andra axel — svaret säger vad, tillförsikten säger om du bör agera. Noul-svar har inget tillförsiktsfält, eftersom sannolikheten själv redan bär det: 0,51 är modellen som säger att den inte vet.
Kan Jev hallucinera?
Inte i formen på sin utdata. En Choice kan bara returnera ett av de alternativ du definierat; en Score kan bara landa inom ditt kriterium; en Noul är ett tal mellan 0 och 1. Den kan ändå ha fel om din text — och det är precis vad tillförsikten är till för.
Varför heter den Jev?
Efter nationalekonomen William Stanley Jevons. TypeSafes lanseringsinlägg säger att de förväntar sig att maskinintelligens följer den väg kolet tog när ångmaskiner blev effektiva — Jevons paradox, där något som blir billigare att använda används mer i stället för mindre.
Kan jag köra Jev lokalt? Är den öppen källkod?
Nej. Jev är en proprietär, hostad modell som nås över TypeSafes HTTP-API; det finns inga publicerade vikter att ladda ned, och samma vikter betjänar varje konto — den finjusteras inte och LoRA-anpassas inte per kund. Du formar svaren genom förfrågan i stället: vad du lägger i tillståndet och hur du skriver varje frågas instruktioner och kriterier.
Hur snabb är Jev?
TypeSafe anger 70–500 ms från ände till ände, mot 3–329 sekunder för frontlinjemodeller, och 40–200× snabbare på den typ av fråga den är byggd för. Det är leverantörens siffror. Vad den här sajten kan säga från sina egna loggar är att en förfrågan med nio frågor vanligtvis kommer tillbaka på några hundra millisekunder — varje resultatsida visar den uppmätta tiden tur och retur för just det anropet.
Vad kostar Jev?
0,042 $ per miljon indata-tokens på jev-1.13.0, med utdata gratis — det finns ingen autoregressiv avkodning att mäta. Eftersom tillståndet läses en gång och varje fråga utvärderas mot det parallellt kostar tio frågor ungefär lika mycket som en. Varje resultatsida på den här sajten skriver ut antalet tokens och kostnaden för exakt det anropet.
Hur tränades Jev?
Med det TypeSafe kallar RLCD — förstärkningsinlärning för kalibrerade beslut. Det uttalade målet skiljer sig från RLHF och RLVR: inte svar som människor föredrar eller svar som klarar en kontroll, utan svar vars sannolikheter är epistemiskt ärliga. Det är vad som gör tillförsikt värd att sätta tröskel på i stället för dekorativ.
Vilka är gränserna?
Bara text in — ingen bild, ljud eller video. 64k tokens per förfrågan, varav tillståndet plus den längsta enskilda frågan måste rymmas i 32k. En Choice tar upp till 255 alternativ; en Score tar 2 till 10 nivåer. Hastighetsgränserna i tidig åtkomst är 250 000 tokens per sekund och 1 200 förfrågningar per minut, och TypeSafe varnar för att de ändras.
Så fungerar det →

Rikta Jev mot din egen text

Varje exempel på den här sidan ritades från ett riktigt API-anrop. Klistra in din egen text och se nio typade svar komma tillbaka från en förfrågan.

Öppna lekplatsen