संक्षेप में जवाब
Vercel के 30 सितंबर के ऐलान में Ling 3.1 Flash के 560 अरब पैरामीटर बताए गए। सेवा की सीमाएँ और दस लाख टोकन का विरोधाभासी विवरण आकार से अलग जाँच माँगते हैं।
सार्वजनिक सूची में एक नया विरल मॉडल
Vercel के 30 सितंबर के ऐलान ने InclusionAI के Ling 3.1 Flash की उपलब्धता की पुष्टि की। इसे मिश्रित तर्क मॉडल बताया गया, जिसमें 560 अरब कुल और हर टोकन पर 25 अरब सक्रिय पैरामीटर हैं। मॉडल संदर्भ सीमा और संरचना की तुलना में दोनों संख्याएँ अलग प्रश्नों का उत्तर देती हैं। पहली पूरी सीखी व्यवस्था और दूसरी एक टोकन के समय काम करने वाला हिस्सा बताती है।
यहाँ सत्यापित घटना तारीख वाली उपलब्धता घोषणा और उसके प्रकाशित गुण हैं। एक प्रदाता सूची 29 सितंबर को भी रिलीज तारीख बताती है। इसलिए गेटवे का लेख मूल प्रशिक्षण या पहली रिलीज का पूरा इतिहास नहीं बन जाता। उससे भी महत्वपूर्ण बात यह है कि कोई तारीख या तकनीकी कार्ड अपने आप कठिन काम में प्रतिस्पर्धी से बेहतर शुद्धता का प्रमाण नहीं देता है।
सक्रिय हिस्सा मशीन की बचत नहीं बताता
25 को 560 से भाग देने पर लगभग 4.5 प्रतिशत मिलता है। यह बताए गए पैरामीटर से गणना है, बिजली बचत या जरूरी मेमोरी का माप नहीं। विशेषज्ञों के मिश्रण वाली विरल संरचना बड़ी व्यवस्था के कुछ हिस्से चुनती है। बाकी सीखे पैरामीटर मौजूद रहते हैं। सेवा देने वाली प्रणाली को उन्हें रखना, काम पहुँचाना और उपयोगी विन्यास में पूरा मॉडल चलाना पड़ता है।
इसे बड़े अभिलेख कक्ष की तरह समझ सकते हैं। एक सवाल के लिए कुछ शेल्फ देखे जाते हैं, लेकिन इमारत खुले गलियारे जितनी छोटी नहीं हो जाती। इसी तरह केवल सक्रिय संख्या के आधार पर Ling की तुलना लगभग 25 अरब पैरामीटर वाले घने मॉडल से करने पर भंडारण और सेवा की जरूरत छूट जाएगी। घोषणा सक्रिय हिस्से को चलाने की कुल लागत में बदलने का कोई सार्वभौमिक सूत्र नहीं देती।
| विशेषता | प्रकाशित मान | सीमा |
|---|---|---|
| कुल / सक्रिय पैरामीटर | 560 / 25 अरब | पूरा मॉडल और प्रति टोकन उपयोग |
| गणना की गई सक्रिय हिस्सेदारी | लगभग 4.5% | 25 को 560 से भाग; मेमोरी हिस्सा नहीं |
| Vercel संदर्भ / आउटपुट | 262K / 32,768 टोकन | इनपुट और उत्तर संदर्भ बाँटते हैं |
| Novita संदर्भ विवरण | परिचय में 10 लाख; पैनल में 256K | दस्तावेज का विरोधाभास अनसुलझा |
संदर्भ के दस्तावेज अलग बातें कहते हैं
Vercel की घोषणा 262K टोकन का संदर्भ बताती है। विस्तृत पृष्ठ अधिकतम 32,768 आउटपुट टोकन और इनपुट तथा उत्तर के साझा संदर्भ की बात करता है। Novita कुल और सक्रिय पैरामीटर पर सहमत है, लेकिन परिचय में दस लाख टोकन और समर्थित सुविधाओं के पैनल में 256K लिखता है। इससे दस लाख टोकन की एक समान सेवा गारंटी स्थापित नहीं होती है।
इस अंतर को स्पष्ट रखना जिम्मेदार व्याख्या है। लगभग 256K और 262K अलग संक्षिप्त लिखावट हो सकती हैं, मगर किसी को चुपचाप दस लाख नहीं मानना चाहिए। उपयोगकर्ता को चुने हुए सेवा पते पर लागू सीमा चाहिए। कोई दस्तावेज मॉडल की विज्ञापित संरचनात्मक क्षमता में आ सकता है, फिर भी प्रदाता की सेटिंग से बड़ा हो सकता है। सफल अनुरोध भी पूरे पाठ से सही याद रखने का प्रमाण नहीं है।
तर्क आउटपुट की जगह भी लेता है
गेटवे दस्तावेज के अनुसार तर्क के टोकन अधिकतम आउटपुट में गिने जाते हैं। इसलिए छोटा अंतिम उत्तर चाहिए तब भी बजट जरूरी है। कठिन सवाल दृश्यमान जवाब से पहले काफी अंदरूनी गणना माँग सकता है। केवल बड़ा दस्तावेज क्षेत्र मिलने से नहीं पता चलता कि निर्देश, पुरानी बातचीत, उपकरण के परिणाम और माँगी गई अंतिम व्याख्या के लिए कितनी जगह बची रहेगी।
एक काल्पनिक अनुबंध तुलना में दो लंबे दस्तावेज पूरी इनपुट सामग्री नहीं हैं। उपयोगकर्ता तुलना के मानदंड, संशोधन और पिछली सफाई भी देता है। उपयोगी परीक्षण सही इनपुट आकार और आउटपुट सीमा दर्ज करेगा, फिर देखेगा कि जवाब दूर के अंशों से प्रमाण लेता है या नहीं। यह सुझाई गई जाँच है; VJOURNAL ने Ling पर अनुबंध चलाकर परिणाम मापने का दावा नहीं किया है।
विशेषताएँ गुणवत्ता की रैंकिंग नहीं बनातीं
स्रोत मॉडल को कोड, कई चरणों के विश्लेषण और उपकरण इस्तेमाल करने वाले एजेंट के लिए बताते हैं। यह इच्छित उपयोग है। इनमें समान कार्य, निर्देश, तर्क बजट और सेवा स्थिति वाला स्वतंत्र तुलनात्मक प्रयोग नहीं दिया गया है। बहुत सारे पैरामीटर या लंबे अनुरोध का स्वीकार हो जाना इस प्रमाण की कमी पूरी नहीं करता। उससे हर दूर की शर्त पर सही तर्क की गारंटी भी नहीं मिलती।
अच्छी तुलना दस्तावेज में जानकारी ढूँढना, मिले तथ्य पर तर्क करना और सही उपकरण बुलाना अलग रखेगी। मॉडल एक वाक्य खोज सकता है, लेकिन दूर रखी दो शर्तें मिलाने में चूक सकता है। वह सही प्रारूप में गलत तर्क वाला कार्य कॉल भी दे सकता है। इन परिणामों को अलग गिनने से संरचना की चर्चा काम की बनती है, बिना असंबंधित संख्याओं से कृत्रिम विजेता बनाए।
रिलीज एक जाँचा जा सकने वाला विकल्प है
घोषणा में गेटवे प्रचार 13 अक्टूबर तक है। उसके बाद एक पहचान शुल्क लेना शुरू करती है, जबकि दूसरी सेवा बंद कर देती है। इससे परीक्षण आसान हो सकता है, लेकिन अस्थायी मुफ्त कीमत संरचना की श्रेष्ठता नहीं है। मॉडल का निष्कर्ष विरल डिजाइन और प्रकाशित सीमाओं पर आधारित है। बजट का फैसला इस्तेमाल के समय चुने प्रदाता की वास्तविक शर्तें देखकर अलग लेना होगा।
1 अक्टूबर तक Ling 3.1 Flash लंबे पाठ और तर्क के लिए सत्यापित नया विकल्प है, साथ में संदर्भ विवरण का अनसुलझा अंतर भी है। अगला मजबूत प्रमाण स्पष्ट सीमा और दोहराए जा सकने वाले कार्य परिणाम साथ देगा। हमारी व्याख्या में उपयोगी संदर्भ का अर्थ तय खर्च और जगह में सही प्रमाण वाला उत्तर है, उत्पाद के किसी भी पृष्ठ पर मिली सबसे बड़ी टोकन संख्या नहीं।
सवाल और जवाब
क्या सक्रिय पैरामीटर ही पूरी मशीन की जरूरत बताते हैं?
नहीं। वे एक टोकन के लिए इस्तेमाल हिस्से को बताते हैं। बड़े मॉडल के बाकी पैरामीटर, मेमोरी, काम का वितरण और सेवा ढाँचा भी महत्वपूर्ण हैं। सक्रिय संख्या से पूरी लागत या हार्डवेयर तय नहीं होता।
क्या दस लाख टोकन के संदर्भ पर भरोसा किया जा सकता है?
Novita का परिचय दस लाख कहता है, पर उसका तकनीकी पैनल 256K और Vercel 262K बताता है। यह विरोधाभास अनसुलझा है। चुनी सेवा की लागू सीमा को अलग सत्यापित करना चाहिए।
क्या मॉडल ने स्वतंत्र तुलना में बेहतर सटीकता साबित की है?
यहाँ जाँचे स्रोत पहुँच और विशेषताएँ बताते हैं। समान कार्य, तर्क बजट और स्थितियों वाला स्वतंत्र परीक्षण नहीं देते। इसलिए लेख इन आँकड़ों से श्रेष्ठता की रैंकिंग नहीं बनाता।
