> methodology.md
Cara kami mengukur
Halaman ini adalah tempat sebenar untuk membaca bagaimana dakwaan kualiti dan kos Maguyva diasaskan. Ia hanya berdasarkan fakta: apa yang kami ukur, bagaimana kami menilainya, dan apa yang tidak kami dakwa telah diaudit.
Berkuat kuasa mulai 17 Julai 2026. Tiada penanda aras baharu yang belum diaudit direka di sini. Kiraan semasa terletak pada permukaan produk yang dijana semula daripada data sumber; halaman ini menerangkan model pengukuran.
Ini ialah terjemahan bantuan AI yang disediakan untuk kemudahan anda. Versi rasmi Bahasa Inggeris adalah satu-satunya versi yang mengikat — sebarang perjanjian yang anda masuki semasa mendaftar tertakluk kepada teks Bahasa Inggeris. Baca versi rasmi Bahasa Inggeris
tl;dr — Dakwaan kualiti berasaskan fixture release gates dan papan language-audit pelbagai dimensi — bukan satu bukti “ketepatan 100%”. Hijau pada fixture bukan bermaksud sama dengan pengekstrakan betul yang disahkan secara bebas. Dakwaan kos adalah pengiraan harga workspace dan ketelusan kos operasi awam, bukan audit persaingan pihak ketiga.
1. Mengapa Halaman Ini Wujud
Pembeli yang skeptikal tidak sepatutnya perlu melakukan kejuruteraan songsang ke atas teks pemasaran. Maguyva mengindeks repositori dan memaparkan dakwaan ketepatan, liputan bahasa dan kos di seluruh laman. Dakwaan tersebut memerlukan permukaan metodologi yang jujur tentang skop pengukuran: apa yang disokong fixture, apa yang disokong penilaian pakar, dan apa yang hanya penyusunan kata, bukan pensijilan bebas.
2. Apa Yang Kami Ukur
Kualiti code intelligence diukur terutamanya pada language engine — pengekstrakan simbol, hubungan dan graf daripada kod sumber — bukan pada skor “kepuasan agen” yang subjektif.
- Set fixture mengikut bahasa: edge dan simbol yang dijangka yang mesti diekstrak dengan betul oleh handler
- Release gates: bahasa hanya dilancarkan apabila ketepatan, recall dan F1 pada fixture melepasi ambang yang diterbitkan (ketepatan ≥ 0.95, recall ≥ 0.99, F1 ≥ 0.97 pada fixture, dengan bilangan edge minimum untuk keyakinan statistik)
- Dimensi language-audit: ketepatan, integriti struktur, kesempurnaan, kualiti dan prestasi pada papan pengesahan
- Gelung korpus dan pemeriksaan spot: edge yang disampel daripada repositori sebenar diklasifikasikan mengikut rubrik (betul, positif palsu, ralat jenis/skop/metadata) — diterangkan dalam catatan blog language-grind kami
- Penanda keupayaan produk: apa yang benar-benar ditawarkan pelayan (AST, pemboleh ubah setempat, pengekstrakan graf) — berasingan daripada saiz katalog
Penting: Fixture disahkan terhadap fixture yang kami tulis sendiri. HIJAU bermaksud kes yang diketahui lulus. Ini tidak secara automatik bermaksud setiap ungkapan dunia sebenar diekstrak dengan bersih. Perbezaan ini adalah sengaja dan dinyatakan secara terbuka.
3. Hijau Berbanding Disahkan Secara Bebas
Papan language-audit menggunakan pelbagai paksi supaya satu lampu hijau tidak boleh dibaca sebagai “dibuktikan sempurna”. Angka utama pada papan biasanya dibahagikan kepada:
- overall_green — tiada regresi berbanding fixture self-snapshot dan gate korpus berkaitan (perlu, tetapi tidak mencukupi)
- independently_verified — mempunyai isyarat penilaian yang kukuh seperti benih pemeriksaan spot (termasuk bahasa yang masih menunjukkan ralat yang telah dinilai)
- verified_clean / sifar ralat yang dinilai pada edge yang disampel — subset bahasa yang dinilai dengan lebih ketat
- kurasi / kepercayaan oracle — sama ada fixture itu sendiri dianggap sebagai oracle yang boleh dipercayai
- penanda struktur — pengekstrakan graf dan keupayaan AST tidak sama dengan keahlian katalog semata-mata
Bilangan bahasa dalam bahasa pemasaran (contohnya “279+ bahasa”) adalah saiz katalog: bahasa yang dikonfigurasi dan entri pelayan. Saiz katalog bukan SLA kualiti AST. Kami lebih suka pelaporan berperingkat berbanding satu angka besar yang menarik perhatian. Untuk permukaan produk semasa, lihat Keserasian dan Panduan Bahasa; untuk perincian naratif, lihat catatan penambahbaikan diri rekursif bahasa di blog.
4. Kualiti Carian Dan Pengambilan
Kualiti semantic search adalah pelbagai mod: teks, AST, graf dan embedding digabungkan. Kami mendokumenkan pertukaran kejuruteraan yang disengajakan dan bukan mendakwa pengambilan yang tidak dapat dikalahkan:
- Embedding menggunakan keluarga model komersial (voyage-4-large setakat snapshot blog Jun 2026), dipilih berdasarkan papan pendahulu pengambilan awam pada masa keputusan dibuat
- Vektor dikuantumkan secara binari untuk penyimpanan dan kos; ini sengaja menukar sebahagian ketepatan pengambilan untuk carian Hamming yang lebih murah dan lebih pantas tanpa pangkalan data vektor berasingan
- Penghalaan niat dan pemberat gabungan adalah heuristik kejuruteraan dengan kesan operasi yang diukur (contohnya kadar keputusan sifar yang lebih rendah selepas penghalaan niat), bukan suite penilaian IR bebas yang diterbitkan pada korpus pelanggan
- Catatan blog termasuk bahagian “apa yang masih tidak sempurna” — isyarat yang tidak sempurna adalah sebahagian daripada rekod, bukan nota kaki yang disembunyikan
5. Dakwaan Kos
Bahasa kos pada Maguyva berkaitan dengan struktur harga dan ketelusan operasi, bukan kajian TCO formal yang disahkan oleh pihak ketiga.
- Harga workspace: dicaj mengikut repositori, baris yang diindeks dan kekerapan rebuild — bukan mengikut setiap kerusi manusia atau agen. FAQ dan teks pelan menjelaskan dimensi-dimensi ini.
- Perbandingan gaya “kira-kira 10–30x lebih murah” pada halaman Pricing adalah pengiraan ilustrasi berbanding julat harga setiap kerusi yang biasa, bergantung pada alat berharga setiap kerusi yang anda bandingkan. Ia bukan pakej penanda aras persaingan bebas yang dikunci.
- Kejujuran kos operasi: halaman /team menerbitkan pecahan perbelanjaan perisian bulanan sebenar (langganan, alatan MCP/search, kos mengikut penggunaan). Ini adalah ketelusan customer-zero, bukan penyata kewangan yang diaudit.
- Kos embedding dan infrastruktur adalah kos produk yang diterima (embedding premium, penyimpanan, rebuild graf). Kami menanggungnya secara sengaja dan menyatakannya secara terbuka dalam catatan voyage-4-large dan naratif harga.
6. Apa Yang Tidak Kami Dakwa
Halaman ini juga merupakan senarai bukan-dakwaan. Jika sesuatu tiada pada papan pengukuran, jangan anggap nada pemasaran sebagai bukti.
- Tiada jaminan ketepatan mutlak menyeluruh untuk setiap bahasa. Ambang fixture terpakai bagi setiap bahasa pada kes yang diketahui; ralat dunia sebenar yang berbaki dijangka dan berasaskan realiti.
- Tiada dakwaan bahawa overall_green bersamaan dengan pengekstrakan sempurna pengeluaran untuk setiap ungkapan dalam setiap repositori
- Tiada pakej pensijilan pematuhan pihak ketiga yang dikemukakan sebagai artifak metodologi pada permukaan ini (lihat Keselamatan untuk fakta pengendalian data, bukan lencana pematuhan)
- Tiada perbandingan bebas pelbagai vendor dengan korpus dikongsi yang diterbitkan sebagai kad skor tetap
- Hasil carian dan analisis kekal usaha terbaik (best-effort) di bawah Terma Perkhidmatan — Maguyva bukan pengganti untuk semakan kod, ujian, atau audit keselamatan
7. Cara Mengesahkan Sendiri
Pergerakan pembeli yang dimaksudkan masih: indeks repositori yang sudah anda fahami, tanya satu soalan sebenar, dan periksa petikan.
- Mula secara percuma: repositori kecil yang mewakili mengatasi indeks seluruh syarikat pada hari pertama
- Gunakan alat MCP (intelligent_search, find_symbol, dependency_search) dan buka laluan yang dipetik
- Baca Cara Ia Berfungsi untuk seni bina ingestion dan pengambilan
- Baca Keserasian dan Panduan Bahasa untuk peringkat keupayaan, bukan sekadar saiz katalog
- Baca Keselamatan dan Privasi untuk pengendalian data; halaman ini tidak menggantikannya