यह कैसे काम करता है

Dejev एक API कॉल के चारों ओर लिपटा एक पतला, दृश्य आवरण है। परिणाम पृष्ठ पर सब कुछ एक ही POST /v1/systemone से आता है।

पूरा अनुरोध

अवस्था आप देते हैं — जो भी आप चिपकाते हैं। प्रश्न लेंस देता है। Jev प्रति प्रश्न एक टाइप किया हुआ उत्तर लौटाता है, उन्हीं आईडी से कुंजीबद्ध।

{
  "state": "Help! My payouts have been failing for 3 days.",
  "model": "jev-latest",
  "questions": {
    "is_urgent":  { "type": "noul",   "instructions": "Does this convey urgency?" },
    "department": { "type": "choice", "instructions": "Which team should handle this?",
                    "criteria": { "billing": "Payments, invoicing, refunds",
                                  "technical": "Bugs, outages, integrations",
                                  "sales": "Pricing, upgrades, new accounts" } },
    "frustration":{ "type": "score",  "instructions": "How frustrated is the customer?",
                    "criteria": ["Calm", "Frustrated", "Very angry"] }
  }
}

चार्ट उत्तरों से कैसे मेल खाते हैं

Choice → डोनट
प्रायिकताओं का योग एक होता है, इसलिए यहाँ वलय ईमानदार है: यह सचमुच अंश-से-पूर्ण का संबंध है। लेजेंड हर विकल्प को उसके सटीक मान के साथ दोहराता है, क्योंकि नज़दीकी मुक़ाबलों में डोनट कमज़ोर पड़ता है जबकि संख्याएँ नहीं।
Score → मानदंड पट्टी
पट्टी आपके स्तरों को क्रम में दिखाती है; सुई प्रायिकता-भारित मान है, इसीलिए वह अक्सर दो स्तरों के बीच गिरती है। नीचे के दंड दिखाते हैं कि प्रायिकता का भार कैसे फैला है — एक संकरी चोटी से आया 2.0 और दो दूर-दूर के उभारों से आया 2.0 बहुत अलग उत्तर हैं।
Noul → मीटर
एक सीमा के सापेक्ष एक अनुपात, इसलिए इसे चार्ट के बजाय मीटर मिलता है। बीच में बनी धूसर पट्टी वह जगह दिखाती है जहाँ मॉडल असल में कह रहा होता है “मुझे नहीं पता” — 0.51 को कभी हाँ नहीं पढ़ना चाहिए।

लेंस

हर लेंस बस प्रश्नों का एक नियत समूह है, जो Jev की क्षमताओं का एक अलग पहलू दिखाने के लिए चुना गया है। आप अपने भी लिख सकते हैं।

  • संदेश का एक्स-रे

    यह संदेश असल में आपसे क्या माँग रहा है?

    9 प्रश्न

  • सहायता छँटाई

    टिकट को किसी व्यक्ति के खोलने से पहले ही आगे भेजिए।

    9 प्रश्न

  • सुरक्षा रोक

    किसी प्रॉम्प्ट को अपने मॉडल तक पहुँचने से पहले छानिए।

    9 प्रश्न

  • मसौदे की समीक्षा

    भेजने से पहले एक मसौदे पर नौ पाठ।

    9 प्रश्न

  • समीक्षा का विश्लेषक

    ग्राहक की समीक्षा असल में आपसे क्या कह रही है।

    9 प्रश्न

  • बग रिपोर्ट की छँटाई

    गंभीरता, घटक, और क्या कोई इसे दोहरा सकता है।

    9 प्रश्न

  • शीर्षक लेंस

    किसी ख़बर को किस ढाँचे में रखा जा रहा है।

    9 प्रश्न

  • प्रस्तुति की जाँच

    क्या कोई निवेशक या ग्राहक आगे पढ़ता रहेगा?

    9 प्रश्न

प्रश्न

System One मॉडल क्या है?
एक ऐसा मॉडल जो गद्य के बजाय निर्णयों के लिए बनाया गया है। Jev एक अवस्था और टाइप किए हुए प्रश्नों का एक मानचित्र लेता है और प्रति प्रश्न एक टाइप किया हुआ उत्तर लौटाता है — कोई टोकन धारा नहीं, पार्स करने को कुछ नहीं, और आपके तय किए समुच्चय के बाहर कोई मान निकालने का कोई रास्ता नहीं। TypeSafe का ढाँचा यह है: तेज़ संरचित निर्णय के लिए System One, और जब सचमुच भाषा चाहिए तब System Two के रूप में एक सामान्य भाषा मॉडल।
सब कुछ एक ही अनुरोध में क्यों चलता है?
Jev अवस्था को एक बार ग्रहण करता है और हर प्रश्न को उसके सापेक्ष समानांतर रूप से आँकता है। एक कॉल में दस प्रश्नों की लागत दस के बजाय लगभग एक कॉल जितने इनपुट टोकन की होती है, और समय भी लगभग एक कॉल जितना लगता है। इसीलिए यहाँ हर लेंस प्रॉम्प्ट जोड़ने के बजाय एक साथ नौ चीज़ें पूछता है।
विश्वास का क्या अर्थ है?
Choice और Score के उत्तर अपने प्रायिकता वितरण से निकाला गया विश्वास-मान साथ लाते हैं: केंद्रित होने का अर्थ है निश्चित, फैला होने का अर्थ है कि मॉडल विकल्पों को अलग नहीं कर पा रहा। यह एक दूसरा अक्ष है — उत्तर बताता है क्या, विश्वास बताता है कि कार्रवाई करें या नहीं। Noul के उत्तरों में विश्वास का क्षेत्र नहीं होता, क्योंकि प्रायिकता स्वयं वह बात कह देती है: 0.51 वह मॉडल है जो कह रहा है कि उसे नहीं पता।
क्या Jev मतिभ्रम कर सकता है?
अपने आउटपुट के आकार में नहीं। Choice केवल उन्हीं विकल्पों में से एक लौटा सकता है जिन्हें आपने तय किया; Score केवल आपके मानदंड के भीतर गिर सकता है; Noul 0 और 1 के बीच की एक संख्या है। वह फिर भी आपके टेक्स्ट के बारे में ग़लत हो सकता है — और ठीक इसी के लिए विश्वास है।
इसका नाम Jev क्यों है?
अर्थशास्त्री विलियम स्टैनली जेवंस के नाम पर। TypeSafe की घोषणा कहती है कि उन्हें लगता है कि मशीन बुद्धिमत्ता उसी राह पर चलेगी जिस पर भाप इंजनों के कुशल होने के बाद कोयला चला था — जेवंस का विरोधाभास, जिसमें किसी चीज़ का उपयोग सस्ता कर देने से उसका उपयोग घटने के बजाय बढ़ जाता है।
क्या मैं Jev को स्थानीय रूप से चला सकता हूँ? क्या यह ओपन सोर्स है?
नहीं। Jev एक स्वामित्व वाला होस्टेड मॉडल है जिस तक TypeSafe के HTTP API से पहुँचा जाता है; डाउनलोड करने के लिए कोई प्रकाशित भार नहीं हैं, और वही भार हर खाते को सेवा देते हैं — प्रति ग्राहक न कोई फ़ाइन-ट्यूनिंग है न LoRA अनुकूलन। आप उसके उत्तरों को अनुरोध के ज़रिए गढ़ते हैं: इससे कि आप अवस्था में क्या डालते हैं, और इससे कि आप हर प्रश्न के निर्देश और मानदंड कैसे लिखते हैं।
Jev कितना तेज़ है?
TypeSafe छोर-से-छोर 70–500 ms बताता है, जबकि अग्रणी मॉडलों के लिए यह 3–329 सेकंड है, और जिस तरह के प्रश्नों के लिए वह बना है उनमें 40–200 गुना तेज़। ये विक्रेता के आँकड़े हैं। यह साइट अपने लॉग से जो कह सकती है वह यह है कि नौ प्रश्नों वाला अनुरोध आम तौर पर कुछ सौ मिलीसेकंड में लौटता है — हर परिणाम पृष्ठ उस विशेष कॉल का मापा गया आना-जाना समय दिखाता है।
Jev की क़ीमत क्या है?
jev-1.13.0 पर प्रति दस लाख इनपुट टोकन $0.042, और आउटपुट निःशुल्क — मापने के लिए कोई स्वतःप्रतिगामी डिकोडिंग है ही नहीं। चूँकि अवस्था एक बार पढ़ी जाती है और हर प्रश्न उसके सापेक्ष समानांतर आँका जाता है, दस चीज़ें पूछने की लागत लगभग एक पूछने जितनी होती है। इस साइट का हर परिणाम पृष्ठ उसी कॉल की टोकन संख्या और लागत छापता है।
Jev को प्रशिक्षित कैसे किया गया?
उस विधि से जिसे TypeSafe RLCD कहता है — अंशांकित निर्णयों के लिए सुदृढ़ीकरण अधिगम। घोषित लक्ष्य RLHF या RLVR से अलग है: ऐसे उत्तर नहीं जो लोगों को पसंद आएँ, और ऐसे भी नहीं जो किसी जाँचक से पास हो जाएँ, बल्कि ऐसे उत्तर जिनकी प्रायिकताएँ ज्ञानमीमांसीय रूप से ईमानदार हों। यही विश्वास को सजावट के बजाय सीमा तय करने योग्य बनाता है।
सीमाएँ क्या हैं?
केवल टेक्स्ट अंदर जाता है — कोई चित्र, ऑडियो या वीडियो नहीं। प्रति अनुरोध 64k टोकन, जिनमें अवस्था और सबसे लंबा एकल प्रश्न मिलकर 32k में समाने चाहिए। Choice अधिकतम 255 विकल्प लेता है; Score 2 से 10 स्तर लेता है। प्रारंभिक पहुँच में दर सीमाएँ प्रति सेकंड 2,50,000 टोकन और प्रति मिनट 1,200 अनुरोध हैं, और TypeSafe चेताता है कि ये बदलती रहती हैं।
मैं जो चिपकाता हूँ उसका क्या होता है?
उसे आकलन के लिए TypeSafe को भेजा जाता है और इस साइट के डेटाबेस में रखा जाता है ताकि परिणाम का एक स्थायी लिंक बने। सार्वजनिक रन खोजें पृष्ठ पर और सर्च इंजनों में दिखते हैं। असूचीबद्ध रन भी रखे जाते हैं, पर उन्हें खोजें पृष्ठ और साइटमैप से बाहर रखा जाता है और noindex हेडर के साथ परोसा जाता है — लिंक फिर भी उस हर व्यक्ति के लिए काम करता है जिसे आप दें। दोनों ही सूरतों में: कुछ भी संवेदनशील मत चिपकाइए, यह एक सार्वजनिक डेमो है।
यह साइट कौन-सी भाषाएँ बोलती है?
इंटरफ़ेस, लेंस पुस्तकालय और हर व्याख्यात्मक पृष्ठ 32 भाषाओं में प्रकाशित होते हैं, जिन्हें हेडर से या आपके ब्राउज़र की भाषा सेटिंग से चुना जाता है। आप जो चिपकाते हैं वह ठीक वैसा ही रहता है जैसा आपने लिखा, और Jev उसे उसी भाषा में पढ़ता है जिसमें वह है — हर लेंस के पीछे के प्रश्न हर भाषा में अंग्रेज़ी में भेजे जाते हैं, इसलिए एक रन का अर्थ वही रहता है चाहे वह कैसे भी बनाया गया हो।
क्या इसे TypeSafe चलाता है?
नहीं। Dejev एक स्वतंत्र डेमो है जो यह दिखाने के लिए बनाया गया है कि Jev का आउटपुट चित्रित करने पर कैसा दिखता है। मॉडल, API और दस्तावेज़ TypeSafe के हैं।

और गहराई में

मॉडल, क़ीमत, खुरदरे किनारे और रेसिपी-पुस्तकों की एक लंबी क़तार — सब कुछ TypeSafe के अपने दस्तावेज़ों में है।