> methodology.md
Cara kami mengukur
Halaman ini adalah tempat sebenarnya untuk membaca bagaimana klaim kualitas dan biaya Maguyva didasarkan. Halaman ini hanya berisi fakta: apa yang kami ukur, bagaimana kami menilainya, dan apa yang tidak kami klaim telah diaudit.
Berlaku mulai 17 Juli 2026. Tidak ada benchmark baru yang belum diaudit yang dibuat-buat di sini. Angka terkini tersedia di permukaan produk yang diregenerasi dari data sumber; halaman ini menjelaskan model pengukurannya.
Ini adalah terjemahan bantuan AI yang disediakan untuk kenyamananmu. Versi resmi berbahasa Inggris adalah satu-satunya yang mengikat secara hukum — setiap perjanjian yang kamu setujui saat mendaftar tunduk pada teks berbahasa Inggris. Baca versi resmi berbahasa Inggris
tl;dr — Klaim kualitas didasarkan pada fixture release gates dan papan language-audit multi-dimensi — bukan pada satu bukti “presisi 100%”. Hijau pada fixture tidak sama dengan ekstraksi yang benar dan telah diverifikasi secara independen. Klaim biaya adalah perhitungan harga workspace dan transparansi biaya operasional publik, bukan audit kompetitif pihak ketiga.
1. Mengapa Halaman Ini Ada
Pembeli yang skeptis tidak seharusnya perlu melakukan reverse-engineering pada teks pemasaran. Maguyva mengindeks repositori dan menampilkan klaim presisi, cakupan bahasa, dan biaya di seluruh situs. Klaim tersebut membutuhkan permukaan metodologi yang jujur soal cakupan pengukuran: apa yang didukung fixture, apa yang didukung penilaian ahli, dan apa yang sekadar framing, bukan sertifikasi independen.
2. Apa yang Kami Ukur
Kualitas code intelligence terutama diukur pada language engine — ekstraksi simbol, relasi, dan graf dari kode sumber — bukan pada skor “kepuasan agen” yang subjektif.
- Rangkaian fixture per bahasa: edge dan simbol yang diharapkan yang harus diekstrak dengan benar oleh handler
- Release gates: bahasa baru dirilis hanya jika presisi, recall, dan F1 pada fixture melewati ambang batas yang dipublikasikan (presisi ≥ 0,95, recall ≥ 0,99, F1 ≥ 0,97 pada fixture, dengan jumlah edge minimum untuk keyakinan statistik)
- Dimensi language-audit: akurasi, integritas struktural, kelengkapan, kualitas, dan performa pada papan validasi
- Loop korpus dan pemeriksaan spot: edge sampel dari repositori nyata yang diklasifikasikan berdasarkan rubrik (benar, false positive, kesalahan tipe/cakupan/metadata) — dijelaskan di postingan blog language-grind kami
- Flag kapabilitas produk: apa yang benar-benar ditawarkan server (AST, variabel lokal, ekstraksi graf) — terpisah dari ukuran katalog
Penting: Fixture divalidasi terhadap fixture yang kami tulis sendiri. HIJAU berarti kasus yang sudah dikenal lolos. Ini tidak secara otomatis berarti setiap idiom dunia nyata terekstrak dengan bersih. Perbedaan ini disengaja dan diumumkan secara terbuka.
3. Hijau vs Terverifikasi Secara Independen
Papan language-audit menggunakan beberapa sumbu sehingga satu lampu hijau tidak bisa dibaca sebagai “terbukti sempurna”. Angka utama pada papan biasanya terbagi menjadi:
- overall_green — bebas regresi terhadap fixture self-snapshot dan gate korpus terkait (perlu, tapi tidak cukup)
- independently_verified — memiliki sinyal penilaian yang kuat seperti seed spot-check (termasuk bahasa yang masih menunjukkan kesalahan yang telah dinilai)
- verified_clean / nol kesalahan yang dinilai pada edge sampel — subset bahasa yang dinilai lebih ketat
- kurasi / kepercayaan oracle — apakah fixture sendiri diperlakukan sebagai oracle tepercaya
- flag struktural — ekstraksi graf dan kapabilitas AST tidak identik dengan keanggotaan katalog
Jumlah bahasa dalam bahasa pemasaran (misalnya “279+ bahasa”) adalah ukuran katalog: bahasa yang dikonfigurasi dan entri server. Ukuran katalog bukan SLA kualitas AST. Kami lebih memilih pelaporan bertingkat daripada satu angka besar yang mentereng. Untuk permukaan produk saat ini, lihat Kompatibilitas dan Panduan Bahasa; untuk detail naratif, lihat postingan perbaikan diri rekursif bahasa di blog.
4. Kualitas Pencarian dan Pengambilan
Kualitas semantic search bersifat multi-modal: teks, AST, graf, dan embedding digabungkan. Kami mendokumentasikan trade-off rekayasa yang disengaja, bukan mengklaim retrieval yang tak terkalahkan:
- Embedding menggunakan keluarga model komersial (voyage-4-large per snapshot blog Juni 2026), dipilih berdasarkan leaderboard retrieval publik pada saat keputusan diambil
- Vektor dikuantisasi biner untuk penyimpanan dan biaya; ini secara sengaja menukar sebagian presisi retrieval demi pencarian Hamming yang lebih murah dan cepat tanpa database vektor terpisah
- Intent routing dan bobot fusi adalah heuristik rekayasa dengan efek operasional yang terukur (misalnya tingkat zero-result yang lebih rendah setelah intent routing), bukan suite evaluasi IR independen yang dipublikasikan pada korpus pelanggan
- Postingan blog menyertakan bagian “apa yang masih belum sempurna” — sinyal yang belum sempurna adalah bagian dari catatan, bukan catatan kaki yang disembunyikan
5. Klaim Biaya
Bahasa biaya pada Maguyva berkaitan dengan struktur harga dan transparansi operasional, bukan studi TCO formal yang disertifikasi pihak ketiga.
- Harga workspace: ditagih berdasarkan repositori, baris terindeks, dan frekuensi rebuild — bukan per kursi manusia atau agen. FAQ dan teks paket menjabarkan dimensi-dimensi ini.
- Perbandingan gaya “kira-kira 10–30x lebih murah” di halaman Pricing adalah matematika ilustratif terhadap rentang harga per kursi yang umum, tergantung alat berbasis kursi mana yang Anda bandingkan. Ini bukan paket benchmark kompetitif independen yang terkunci.
- Kejujuran biaya operasional: halaman /team mempublikasikan rincian pengeluaran perangkat lunak bulanan yang nyata (langganan, tooling MCP/search, biaya yang mengikuti penggunaan). Ini adalah transparansi customer-zero, bukan laporan keuangan yang diaudit.
- Biaya embedding dan infrastruktur adalah biaya produk yang diterima (embedding premium, penyimpanan, rebuild graf). Kami membayarnya dengan sengaja dan mengatakannya secara terbuka di postingan voyage-4-large dan narasi harga.
6. Apa yang Tidak Kami Klaim
Halaman ini juga merupakan daftar hal yang tidak diklaim. Jika sesuatu tidak ada di papan pengukuran, jangan perlakukan nada pemasaran sebagai bukti.
- Tidak ada jaminan presisi absolut menyeluruh untuk setiap bahasa. Ambang batas fixture berlaku per bahasa pada kasus yang diketahui; kesalahan dunia nyata yang tersisa memang diperkirakan dan berbasis kenyataan.
- Tidak ada klaim bahwa overall_green sama dengan ekstraksi sempurna tingkat produksi untuk setiap idiom di setiap repositori
- Tidak ada paket sertifikasi kepatuhan pihak ketiga yang disajikan sebagai artefak metodologi di permukaan ini (lihat Keamanan untuk fakta penanganan data, bukan lencana kepatuhan)
- Tidak ada bake-off independen multi-vendor dengan korpus bersama yang dipublikasikan sebagai scorecard tetap
- Hasil pencarian dan analisis tetap bersifat best-effort di bawah Ketentuan Layanan — Maguyva bukan pengganti untuk code review, pengujian, atau audit keamanan
7. Cara Memverifikasi Sendiri
Alur pembeli yang dimaksudkan tetap: indeks repositori yang sudah Anda pahami, ajukan satu pertanyaan nyata, dan periksa sitasinya.
- Mulai gratis: repositori kecil yang representatif lebih unggul daripada indeks seluruh perusahaan pada hari pertama
- Gunakan alat MCP (intelligent_search, find_symbol, dependency_search) dan buka jalur yang disitasi
- Baca Cara Kerja untuk arsitektur ingestion dan retrieval
- Baca Kompatibilitas dan Panduan Bahasa untuk tingkatan kapabilitas, bukan hanya ukuran katalog
- Baca Keamanan dan Privasi untuk penanganan data; halaman ini tidak menggantikannya