Jev คืออะไร
Jev คือโมเดลสำหรับตัดสินใจ ในขณะที่โมเดลภาษาเขียนข้อความที่คุณต้องมาแยกวิเคราะห์ทีหลัง Jev รับข้อความหนึ่งชิ้นพร้อมแผนที่ของคำถามที่มีชนิดข้อมูล แล้วคืนคำตอบที่มีชนิดข้อมูลหนึ่งคำตอบต่อหนึ่งคำถาม ไม่ว่าจะเป็นความน่าจะเป็น ตัวเลือกที่มีชื่อ หรือตำแหน่งบนเกณฑ์ แต่ละอย่างมีตัวเลขที่ปรับเทียบแล้วติดมาด้วย มันสร้างโดย TypeSafe เข้าถึงผ่าน HTTP API และมันไม่สามารถคืนค่าที่อยู่นอกชุดซึ่งคุณกำหนดไว้ได้
ทำไมมันจึงไม่ใช่โมเดลภาษา
LLM ผลิตโทเคนออกมา รูปแบบของสิ่งที่กลับมาเป็นความหวัง ไม่ใช่การรับประกัน นั่นคือเหตุผลที่แอปพลิเคชันซึ่งใช้มันตัดสินใจลงเอยด้วยการถูกห่อด้วยการแยกวิเคราะห์และการลองใหม่ ส่วน Jev ผลิตค่าที่มีชนิดข้อมูลตามที่คุณระบุ ไม่มีอะไรให้แยกวิเคราะห์และไม่มีกรณีผิดรูปให้ต้องจัดการ สิ่งที่มาแทนวงวนลองใหม่คือกิ่งสำหรับตอนที่โมเดล_ไม่แน่ใจ_ ซึ่งเป็นคนละเรื่องและมีประโยชน์กว่ามาก
Jev เทียบกับโมเดลภาษา →สามรูปแบบ และไม่มีอย่างอื่น
Noul
Noul เป็นหนึ่งในสามชนิดคำถามของโมเดล Jev จาก TypeSafe มันถามคำถามใช่/ไม่ใช่หนึ่งข้อ แล้วตอบด้วยความน่าจะเป็นที่คำตอบคือใช่ ในรูปตัวเลขตั้งแต่ 0 ถึง 1
Choice
Choice เป็นหนึ่งในสามชนิดคำถามของโมเดล Jev จาก TypeSafe มันเลือกตัวเลือกเพียงหนึ่งเดียวจากชุดที่คุณกำหนด แล้วคืนผู้ชนะ ความน่าจะเป็นของทุกตัวเลือก และค่าความมั่นใจ
Score
Score เป็นหนึ่งในสามชนิดคำถามของโมเดล Jev จาก TypeSafe มันให้คะแนนอินพุตตามระดับที่เรียงลำดับซึ่งคุณเขียนเอง แล้วคืนค่าที่ถ่วงน้ำหนักด้วยความน่าจะเป็น ซึ่งตกอยู่ระหว่างสองระดับได้
ตัวเลข
TypeSafe เป็นผู้เผยแพร่ตัวเลขเหล่านี้ เป็นตัวเลขของผู้ให้บริการเอง ไม่ใช่การวัดของเรา
การตอบสนองจากต้นทางถึงปลายทาง เทียบกับ 3–329 วินาทีของโมเดลแนวหน้า
ต่อโทเคนขาเข้าหนึ่งล้าน ขาออกไม่มีค่าใช้จ่าย
บริบทต่อคำขอ
โทเคนขาออก
คำถาม
- โมเดล System One คืออะไร
- โมเดลที่สร้างมาเพื่อการตัดสินใจมากกว่าการเขียนร้อยแก้ว Jev รับสถานะหนึ่งชุดพร้อมแผนที่ของคำถามที่มีชนิดข้อมูล แล้วคืนคำตอบที่มีชนิดข้อมูลหนึ่งคำตอบต่อหนึ่งคำถาม ไม่มีโทเคนไหลออกมา ไม่มีอะไรให้แยกวิเคราะห์ และไม่มีทางที่มันจะให้ค่าที่อยู่นอกชุดซึ่งคุณกำหนดไว้ กรอบคิดของ TypeSafe คือ System One สำหรับการตัดสินเชิงโครงสร้างที่รวดเร็ว โดยมีโมเดลภาษาทั่วไปเป็น System Two เมื่อคุณต้องการภาษาจริง ๆ
- ความมั่นใจหมายถึงอะไร
- คำตอบแบบ Choice และ Score มีค่าความมั่นใจที่คำนวณจากการแจกแจงความน่าจะเป็นของมัน ถ้ากระจุกตัวแปลว่าแน่ใจ ถ้ากระจายแปลว่าโมเดลแยกตัวเลือกออกจากกันไม่ได้ นี่เป็นแกนที่สอง คำตอบบอกว่าอะไร ส่วนความมั่นใจบอกว่าควรลงมือหรือไม่ คำตอบแบบ Noul ไม่มีฟิลด์ความมั่นใจ เพราะตัวความน่าจะเป็นเองก็บอกอยู่แล้ว ค่า 0.51 คือโมเดลกำลังบอกว่ามันไม่รู้
- Jev หลอนได้ไหม
- ไม่ได้ในแง่รูปแบบของผลลัพธ์ Choice คืนได้เฉพาะตัวเลือกที่คุณกำหนดไว้ Score ตกได้เฉพาะภายในเกณฑ์ของคุณ ส่วน Noul เป็นตัวเลขระหว่าง 0 กับ 1 มันยังผิดพลาดเกี่ยวกับข้อความของคุณได้อยู่ ซึ่งนั่นคือเหตุผลที่ความมั่นใจมีอยู่
- ทำไมถึงชื่อ Jev
- ตั้งตามชื่อนักเศรษฐศาสตร์ William Stanley Jevons โพสต์เปิดตัวของ TypeSafe บอกว่าพวกเขาคาดว่าปัญญาประดิษฐ์จะเดินตามเส้นทางที่ถ่านหินเดินหลังจากเครื่องจักรไอน้ำมีประสิทธิภาพขึ้น นั่นคือความย้อนแย้งของ Jevons ที่การทำให้สิ่งหนึ่งใช้ได้ถูกลงกลับทำให้มีการใช้มากขึ้นแทนที่จะน้อยลง
- รัน Jev บนเครื่องตัวเองได้ไหม เป็นโอเพนซอร์สหรือเปล่า
- ไม่ได้ Jev เป็นโมเดลกรรมสิทธิ์ที่โฮสต์ไว้และเข้าถึงผ่าน HTTP API ของ TypeSafe ไม่มีน้ำหนักที่เผยแพร่ให้ดาวน์โหลด และน้ำหนักชุดเดียวกันให้บริการทุกบัญชี ไม่มีการปรับจูนหรือการปรับ LoRA แยกรายลูกค้า คุณกำหนดรูปคำตอบของมันผ่านคำขอแทน ผ่านสิ่งที่คุณใส่ลงในสถานะ และผ่านวิธีที่คุณเขียนคำสั่งและเกณฑ์ของแต่ละคำถาม
- Jev เร็วแค่ไหน
- TypeSafe ระบุ 70–500 มิลลิวินาทีจากต้นทางถึงปลายทาง เทียบกับ 3–329 วินาทีของโมเดลแนวหน้า และเร็วกว่า 40–200 เท่าในคำถามประเภทที่มันถูกสร้างมาเพื่อสิ่งนั้น นั่นเป็นตัวเลขของผู้ให้บริการ สิ่งที่เว็บไซต์นี้พูดได้จากบันทึกของตัวเองคือ คำขอเก้าคำถามมักกลับมาภายในไม่กี่ร้อยมิลลิวินาที ทุกหน้าผลลัพธ์แสดงเวลาไป-กลับที่วัดได้ของการเรียกครั้งนั้น
- Jev ราคาเท่าไร
- 0.042 ดอลลาร์ต่อโทเคนขาเข้าหนึ่งล้านบน jev-1.13.0 โดยขาออกไม่มีค่าใช้จ่าย เพราะไม่มีการถอดรหัสแบบถดถอยอัตโนมัติให้ต้องคิดเงิน เนื่องจากสถานะถูกอ่านครั้งเดียวและทุกคำถามถูกประเมินต่อสถานะนั้นแบบขนาน การถามสิบเรื่องจึงมีต้นทุนพอ ๆ กับการถามเรื่องเดียว ทุกหน้าผลลัพธ์บนเว็บไซต์นี้พิมพ์จำนวนโทเคนและค่าใช้จ่ายของการเรียกครั้งนั้นออกมา
- Jev ถูกฝึกมาอย่างไร
- ด้วยสิ่งที่ TypeSafe เรียกว่า RLCD หรือการเรียนรู้แบบเสริมกำลังเพื่อการตัดสินใจที่ปรับเทียบแล้ว เป้าหมายที่ประกาศไว้ต่างจาก RLHF หรือ RLVR ไม่ใช่คำตอบที่คนชอบ และไม่ใช่คำตอบที่ผ่านตัวตรวจ แต่เป็นคำตอบที่ความน่าจะเป็นของมันซื่อตรงในเชิงญาณวิทยา นั่นคือสิ่งที่ทำให้ความมั่นใจคุ้มค่าแก่การตั้งเกณฑ์ ไม่ใช่แค่ของประดับ
- ข้อจำกัดคืออะไร
- รับเฉพาะข้อความ ไม่รับภาพ เสียง หรือวิดีโอ 64,000 โทเคนต่อคำขอ โดยสถานะบวกกับคำถามที่ยาวที่สุดหนึ่งข้อต้องอยู่ใน 32,000 โทเคน Choice รับได้ถึง 255 ตัวเลือก ส่วน Score รับ 2 ถึง 10 ระดับ ขีดจำกัดอัตราในช่วงเข้าถึงก่อนคือ 250,000 โทเคนต่อวินาที และ 1,200 คำขอต่อนาที และ TypeSafe เตือนว่าตัวเลขเหล่านี้จะเปลี่ยน
เล็ง Jev ไปที่ข้อความของคุณเอง
ทุกตัวอย่างในหน้านี้วาดขึ้นจากการเรียก API จริง วางข้อความของคุณเองแล้วดูคำตอบที่มีชนิดข้อมูลเก้าคำตอบกลับมาจากคำขอเดียว
เปิดสนามทดลอง