Hvad er Jev?

Jev er en beslutningsmodel. Hvor en sprogmodel skriver tekst, som du bagefter skal tolke, tager Jev ét stykke tekst plus et kort over typede spørgsmål og returnerer ét typet svar pr. spørgsmål — en sandsynlighed, en navngiven mulighed eller en position på en skala — hver med et kalibreret tal hæftet på. Den laves af TypeSafe, nås over et HTTP-API og kan ikke returnere en værdi uden for den mængde, du har defineret.

Hvorfor den ikke er en sprogmodel

En sprogmodel producerer tokens; formen på det, der kommer tilbage, er et håb, ikke en garanti, og derfor ender applikationer, der bruger den til beslutninger, pakket ind i parsing og gentagelser. Jev producerer en værdi af den type, du angav. Der er intet at tolke og intet ødelagt tilfælde at håndtere — det, der erstatter gentagelsesløkken, er en helt anden gren: den, der udløses, når modellen er usikker, hvilket er noget andet og langt mere nyttigt at vide.

Jev mod en sprogmodel →

Tre former, og intet andet

Tallene

TypeSafe udgiver dem; det er leverandørens egne tal, ikke vores målinger.

70–500 ms

svartid fra ende til ende, mod 3–329 s for frontmodeller

0,042 $

pr. million inputtokens, output gratis

64k tokens

kontekst pr. forespørgsel

gratis

outputtokens

Spørgsmål

Hvad er en System One-model?
En model bygget til beslutninger frem for prosa. Jev tager én tilstand plus et kort over typede spørgsmål og returnerer ét typet svar pr. spørgsmål — ingen strømmede tokens, intet at tolke, og ingen måde at afgive en værdi uden for det sæt, du definerede. TypeSafes ramme er System One til hurtig struktureret dømmekraft, med en almindelig sprogmodel som System Two, når du faktisk har brug for sprog.
Hvad betyder tillid?
Choice- og Score-svar bærer en tillidsværdi udledt af deres sandsynlighedsfordeling: koncentreret betyder sikker, spredt betyder, at modellen ikke kan adskille mulighederne. Det er en anden akse — svaret siger hvad, tilliden siger, om du bør handle. Noul-svar har ikke noget tillidsfelt, for sandsynligheden bærer det allerede: 0,51 er modellen, der siger, at den ikke ved det.
Kan Jev hallucinere?
Ikke i formen på sit output. En Choice kan kun returnere en af de muligheder, du definerede; en Score kan kun lande inden for dit kriterium; en Noul er et tal mellem 0 og 1. Den kan stadig tage fejl om din tekst — og det er præcis det, tilliden er til for.
Hvorfor hedder den Jev?
Efter økonomen William Stanley Jevons. TypeSafes lanceringsopslag siger, at de forventer, at maskinintelligens følger den vej, kul tog, efter at dampmaskiner blev effektive — Jevons-paradokset, hvor noget, der bliver billigere at bruge, bliver brugt mere frem for mindre.
Kan jeg køre Jev lokalt? Er den open source?
Nej. Jev er en proprietær, hostet model, der tilgås over TypeSafes HTTP-API; der er ingen offentliggjorte vægte at hente, og de samme vægte betjener hver konto — den finjusteres ikke og LoRA-tilpasses ikke pr. kunde. Du former dens svar gennem forespørgslen i stedet: hvad du lægger i tilstanden, og hvordan du skriver hvert spørgsmåls instruktioner og kriterier.
Hvor hurtig er Jev?
TypeSafe angiver 70–500 ms fra ende til ende, mod 3–329 sekunder for frontmodeller, og 40–200× hurtigere på den slags forespørgsler, den er bygget til. Det er leverandørens tal. Hvad dette site kan sige ud fra sine egne logfiler er, at en forespørgsel med ni spørgsmål typisk kommer tilbage på nogle hundrede millisekunder — hver resultatside viser den målte tur-retur-tid for netop det kald.
Hvad koster Jev?
0,042 $ pr. million inputtokens på jev-1.13.0, med output gratis — der er ingen autoregressiv afkodning at måle. Fordi tilstanden læses én gang, og hvert spørgsmål vurderes mod den parallelt, koster ti spørgsmål omtrent det samme som ét. Hver resultatside på dette site udskriver antallet af tokens og prisen for netop det kald.
Hvordan blev Jev trænet?
Med det, TypeSafe kalder RLCD — forstærkningslæring til kalibrerede beslutninger. Det erklærede mål er et andet end RLHF og RLVR: ikke svar, folk foretrækker, eller svar, der består en kontrol, men svar, hvis sandsynligheder er epistemisk ærlige. Det er dét, der gør tillid værd at sætte tærskel på frem for dekorativ.
Hvad er grænserne?
Kun tekst ind — ingen billeder, lyd eller video. 64k tokens pr. forespørgsel, hvoraf tilstanden plus det længste enkeltspørgsmål skal kunne være i 32k. En Choice tager op til 255 muligheder; en Score tager 2 til 10 niveauer. Hastighedsgrænserne i tidlig adgang er 250.000 tokens i sekundet og 1.200 forespørgsler i minuttet, og TypeSafe advarer om, at de flytter sig.
Sådan virker det →

Ret Jev mod din egen tekst

Hvert eksempel på denne side er tegnet ud fra et rigtigt API-kald. Indsæt din egen tekst, og se ni typede svar komme tilbage fra én forespørgsel.

Åbn legepladsen