> methodology.md
हम कैसे मापते हैं
यह पृष्ठ वस्तुतः वह स्थान है जहाँ आप पढ़ सकते हैं कि Maguyva के गुणवत्ता और लागत संबंधी दावे किस आधार पर टिके हैं। यहाँ केवल तथ्य हैं: हम क्या मापते हैं, उसे कैसे आँकते हैं, और किस चीज़ का लेखा-परीक्षण किए होने का हम दिखावा नहीं करते।
17 जुलाई 2026 से प्रभावी। यहाँ कोई नया, बिना लेखा-परीक्षित बेंचमार्क गढ़ा नहीं गया है। वर्तमान गणनाएँ उत्पाद सतहों पर रहती हैं जो स्रोत डेटा से पुनः उत्पन्न होती हैं; यह पृष्ठ माप के मॉडल को समझाता है।
यह आपकी सुविधा के लिए उपलब्ध कराया गया AI-सहायता प्राप्त अनुवाद है। आधिकारिक अंग्रेज़ी संस्करण ही बाध्यकारी है — साइन अप करते समय आप जिस भी समझौते में प्रवेश करते हैं, वह अंग्रेज़ी टेक्स्ट द्वारा नियंत्रित होता है। आधिकारिक अंग्रेज़ी संस्करण पढ़ें
tl;dr — गुणवत्ता के दावे fixture रिलीज़ गेट और बहु-आयामी language-audit बोर्ड पर आधारित हैं — किसी एकल “100% परिशुद्धता” प्रमाण पर नहीं। fixtures पर हरा होना, स्वतंत्र रूप से सत्यापित सही निष्कर्षण के समान नहीं है। लागत के दावे कार्यक्षेत्र मूल्य-निर्धारण की गणना और सार्वजनिक परिचालन-लागत पारदर्शिता हैं, न कि किसी तीसरे पक्ष का प्रतिस्पर्धी लेखा-परीक्षण।
1. यह पृष्ठ क्यों मौजूद है
संशयी खरीदारों को विपणन-सामग्री को उलट-पलटकर समझने की मशक्कत नहीं करनी चाहिए। Maguyva रिपॉज़िटरी को इंडेक्स करती है और पूरी साइट पर परिशुद्धता, भाषा-कवरेज तथा लागत संबंधी दावे प्रस्तुत करती है। उन दावों को एक ऐसी कार्यप्रणाली-सतह चाहिए जो माप के दायरे के बारे में ईमानदार हो: क्या fixture-समर्थित है, क्या निर्णय-समर्थित है, और क्या मात्र प्रस्तुति है, स्वतंत्र प्रमाणन नहीं।
2. हम क्या मापते हैं
कोड इंटेलिजेंस की गुणवत्ता मुख्यतः भाषा-इंजन पर मापी जाती है — स्रोत से प्रतीकों, संबंधों और ग्राफ़ का निष्कर्षण — न कि व्यक्तिपरक “एजेंट संतुष्टि” अंकों पर।
- प्रति-भाषा fixture सुइट: अपेक्षित एज और प्रतीक जिन्हें हैंडलर को सही ढंग से निकालना होता है
- रिलीज़ गेट: भाषाएँ केवल तभी जारी होती हैं जब fixture परिशुद्धता, रिकॉल और F1 प्रकाशित सीमाओं को पार करें (परिशुद्धता ≥ 0.95, रिकॉल ≥ 0.99, F1 ≥ 0.97 fixtures पर, सांख्यिकीय विश्वास के लिए न्यूनतम edge संख्या सहित)
- language-audit के आयाम: सटीकता, संरचनात्मक अखंडता, पूर्णता, गुणवत्ता, और सत्यापन बोर्ड पर प्रदर्शन
- डेटा-संग्रह और स्पॉट-चेक लूप: वास्तविक रिपॉज़िटरी से नमूने के रूप में लिए गए एज, जिन्हें एक मानदंड द्वारा वर्गीकृत किया जाता है (सही, फ़ॉल्स पॉज़िटिव, प्रकार/दायरा/मेटाडेटा त्रुटि) — हमारी language-grind ब्लॉग पोस्ट में वर्णित
- उत्पाद क्षमता फ़्लैग: सर्वर क्या विज्ञापित करता है (AST, स्थानीय चर, ग्राफ़ निष्कर्षण) — कैटलॉग के आकार से अलग
महत्वपूर्ण: fixtures उन्हीं fixtures के विरुद्ध सत्यापित होते हैं जिन्हें हमने लिखा है। हरा होने का अर्थ है ज्ञात मामले पास हो गए। इसका स्वतः यह अर्थ नहीं कि हर वास्तविक-दुनिया मुहावरा साफ़-साफ़ निकल जाता है। यह भेद जानबूझकर और सार्वजनिक है।
3. हरा बनाम स्वतंत्र रूप से सत्यापित
language-audit बोर्ड कई अक्षों का उपयोग करता है ताकि किसी एकल हरी बत्ती को “सिद्ध रूप से पूर्ण” न पढ़ा जा सके। बोर्ड पर मुख्य आँकड़े प्रायः इस प्रकार विभाजित होते हैं:
- overall_green — स्व-स्नैपशॉट fixtures और संबंधित डेटा-संग्रह गेट के विरुद्ध रिग्रेशन-मुक्त (आवश्यक, पर्याप्त नहीं)
- independently_verified — इसमें एक सशक्त निर्णय-संकेत होता है, जैसे स्पॉट-चेक सीड (उन भाषाओं सहित जिनमें अब भी आँकी गई त्रुटियाँ दिखती हैं)
- verified_clean / नमूना किए गए एज पर शून्य आँकी गई त्रुटि — आँकी गई भाषाओं का एक अधिक कठोर उपसमुच्चय
- curation / संदर्भ-मान विश्वास — क्या fixtures को स्वयं विश्वसनीय संदर्भ-मान के रूप में माना जाता है
- संरचनात्मक फ़्लैग — ग्राफ़ निष्कर्षण और AST क्षमता, कैटलॉग-सदस्यता के समान नहीं हैं
विपणन की भाषा-गणना (उदाहरण के लिए “279+ भाषाएँ”) कैटलॉग का आकार है: कॉन्फ़िगर की गई भाषाएँ और सर्वर प्रविष्टियाँ। कैटलॉग का आकार AST गुणवत्ता का SLA नहीं है। एक ही दिखावटी गिनती के बजाय स्तरीकृत रिपोर्टिंग को प्राथमिकता दें। वर्तमान उत्पाद-सतह के लिए, «संगतता» और «भाषा गाइड» देखें; कथात्मक विवरण के लिए, ब्लॉग पर भाषा-संबंधी पुनरावर्ती स्व-सुधार पोस्ट देखें।
4. खोज और पुनर्प्राप्ति की गुणवत्ता
सिमेंटिक खोज की गुणवत्ता बहु-प्रकारीय है: टेक्स्ट, AST, ग्राफ़ और एम्बेडिंग को संयोजित किया जाता है। हम अजेय पुनर्प्राप्ति का दावा करने के बजाय जानबूझकर किए गए इंजीनियरिंग समझौतों का दस्तावेज़ीकरण करते हैं:
- एम्बेडिंग एक वाणिज्यिक मॉडल परिवार का उपयोग करते हैं (जून 2026 के ब्लॉग स्नैपशॉट के अनुसार voyage-4-large), जिसे निर्णय के समय सार्वजनिक पुनर्प्राप्ति लीडरबोर्ड के विरुद्ध चुना गया था
- वेक्टर भंडारण और लागत हेतु बाइनरी-क्वांटाइज़्ड होते हैं; यह जानबूझकर कुछ पुनर्प्राप्ति परिशुद्धता का समझौता करके, बिना किसी अलग वेक्टर डेटाबेस के, सस्ती और तेज़ Hamming खोज देता है
- आशय-रूटिंग और फ़्यूज़न भार अभियांत्रिकीय अनुमानी नियम हैं जिनके परिचालन-प्रभाव मापे गए हैं (उदाहरण के लिए, आशय-रूटिंग के बाद शून्य-परिणाम दरों में कमी), न कि ग्राहक डेटा-संग्रह पर प्रकाशित कोई स्वतंत्र IR मूल्यांकन सुइट
- ब्लॉग पोस्ट में “अब भी क्या अपूर्ण है” खंड शामिल होते हैं — अपूर्ण संकेत रिकॉर्ड का हिस्सा हैं, छिपाने के लिए फुटनोट नहीं
5. लागत के दावे
Maguyva पर लागत संबंधी भाषा मूल्य-निर्धारण की संरचना और परिचालन-पारदर्शिता के बारे में है, न कि किसी तीसरे पक्ष द्वारा प्रमाणित औपचारिक TCO अध्ययन।
- कार्यक्षेत्र मूल्य-निर्धारण: बिलिंग रिपॉज़िटरी, इंडेक्स की गई पंक्तियों और पुनर्निर्माण-आवृत्ति के आधार पर होती है — न कि प्रति मनुष्य या एजेंट सीट। FAQ और प्लान-सामग्री इन आयामों को स्पष्ट करती है।
- मूल्य-निर्धारण पर “लगभग 10–30 गुना कम” जैसी तुलनाएँ प्रति-सीट के विशिष्ट परास के विरुद्ध उदाहरणात्मक गणित हैं, यह इस पर निर्भर करता है कि आप किस सीट-मूल्य वाले टूल से तुलना करते हैं। ये कोई निश्चित, स्वतंत्र प्रतिस्पर्धी बेंचमार्क पैकेज नहीं हैं।
- परिचालन-लागत में ईमानदारी: /team पृष्ठ एक वास्तविक मासिक सॉफ़्टवेयर-व्यय विवरण प्रकाशित करता है (सदस्यताएँ, MCP/खोज टूलिंग, उपयोग-आधारित लागतें)। यह “ग्राहक-शून्य” पारदर्शिता है, न कि कोई लेखा-परीक्षित वित्तीय विवरण।
- एम्बेडिंग और अवसंरचना लागतें स्वीकृत उत्पाद-लागतें हैं (प्रीमियम एम्बेडिंग, भंडारण, ग्राफ़ पुनर्निर्माण)। हम इन्हें जानबूझकर वहन करते हैं और voyage-4-large पोस्ट तथा मूल्य-निर्धारण के विवरण में यह कहते हैं।
6. हम क्या दावा नहीं करते
यह पृष्ठ उन बातों की भी सूची है जिनका हम दावा नहीं करते। यदि कोई चीज़ माप-बोर्ड पर नहीं है, तो विपणन के लहजे को प्रमाण न मानें।
- हर भाषा के लिए कोई सर्वग्राही, निरपेक्ष-परिशुद्धता की गारंटी नहीं। fixture सीमाएँ प्रति भाषा ज्ञात मामलों पर लागू होती हैं; शेष वास्तविक-दुनिया त्रुटि अपेक्षित है और खुले तौर पर स्वीकृत है।
- यह दावा नहीं कि overall_green हर रिपॉज़िटरी मुहावरे के लिए उत्पादन-स्तर पर पूर्ण निष्कर्षण के बराबर है
- इस सतह पर कार्यप्रणाली-कलाकृति के रूप में प्रस्तुत कोई तीसरे-पक्ष का अनुपालन-प्रमाणन पैकेज नहीं (डेटा-संचालन के तथ्यों के लिए «सुरक्षा» देखें, अनुपालन बैज के लिए नहीं)
- साझा डेटा-संग्रह के साथ कोई स्वतंत्र बहु-विक्रेता तुलना, जो एक स्थायी स्कोरकार्ड के रूप में प्रकाशित हो, नहीं
- खोज परिणाम और विश्लेषण सेवा-शर्तों के अंतर्गत सर्वोत्तम-प्रयास बने रहते हैं — Maguyva कोड समीक्षा, परीक्षण या सुरक्षा लेखा-परीक्षण का विकल्प नहीं है
7. स्वयं कैसे सत्यापित करें
इच्छित खरीदार-प्रक्रिया अब भी यही है: ऐसी किसी रिपॉज़िटरी को इंडेक्स करें जिसे आप पहले से समझते हैं, एक वास्तविक प्रश्न पूछें, और उद्धरणों का निरीक्षण करें।
- मुफ़्त शुरू करें: पहले ही दिन पूरी कंपनी के इंडेक्स से बेहतर छोटी, प्रतिनिधिक रिपॉज़िटरी हैं
- MCP टूल (intelligent_search, find_symbol, dependency_search) का उपयोग करें और उद्धृत पथ खोलें
- अंतर्ग्रहण और पुनर्प्राप्ति की वास्तुकला के लिए «यह कैसे काम करता है» पढ़ें
- क्षमता-स्तरों के लिए «संगतता» और «भाषा गाइड» पढ़ें, केवल कैटलॉग-आकार नहीं
- डेटा-संचालन के लिए «सुरक्षा» और «गोपनीयता» पढ़ें; यह पृष्ठ उनका स्थान नहीं लेता